https://linux.do 论坛的话题更新通知频道。
TOT 在 Deepseek V4 Pro在Harness/Opencode以及Kimi-K3对比。 中发帖
使用DS Harness/Opencode对DeepSeek v4 Pro正式版进行了测试,并附Kimi K3在Kimi桌面版Work模式的测试结果作为对照。
所有提示词均为如下一条:
[PixPin_2026-08-13_23-58-35]
测试结果:
kimi k3效果最好,耗时49分钟。
最终占用 125k 上下文。订阅额度无法获取
dsv4p-max_dsh 效果居中,耗时40分钟。
最终占用 184K 上下文,总输入10M 缓存率99.5% 总输出143K
dsv4p-max_oc-pure 效果最差,耗时62分钟。
最终占用 227.2K 上下文,总输入22.4M 缓存率98.52% 总输出149K
佬们可以访问对比下,或自行下载html测试。
3D电脑测试结果.zip (66.7 KB)
一、 DeepSeek V4 Pro Max思考 - DS...羽织 (@Lianues) 在 清算ds v4p的风波与问题 中发帖
1.7月初v4p灰测模型问题
v4p正式版发布后,灰测是fable5就是实锤了,佬们也不用瞎想这模型去哪了🤣
2.v4p能力出奇的烂
官方跑分很高,和4.8op打的有来有回:
[v4_260813_benchmark_table_en]
然而第三方跑分很烂:
知乎猫老板的code榜单:
[image(42)]
AA榜:
[Screenshot_2026-08-13-11-52-01-19_40deb401b9ffe8e1df2f1cc5ba480b12]
codex雷达:
[Screenshot_20260813_235056]
[Screenshot_20260813_235108]
还有一些垃圾前端审美测试,就不发了
即便是配合dsh:
[Screenshot_20260813_221139]
别说打4.8op了,连glm-5.2都赢不了
3.大涨...yorokami 在 Deepseek好喜欢偷懒 中发帖
在opencode上接入了deepseek,准备把目标小说文本丢进去提炼下剧情构建啥啥的agent,看看效果准备。这本书一共8部。结果它扫完第一部后面就开始抽样扫了,后续每章抽样了2-3章就结束了这轮任务,我用必须,严格执行去限制它全部扫描,结果还是不听一直偷懒 😶RRR (@iCR) 在 新人问问各位佬vscode copilot的harness是什么水平? 中发帖
我在之前copilot教育优惠还不错的时候开始用copilot,后来缩水了就转订阅gpt了。但codex的使用手感体感上着实差copilot不少,copilot的添加文件和片段,控制能使用的工具以及增加自定义指令和skill等功能都比codex好太多了,终端和命令运行这一块也是,以至于我现在都是用扩展在copilot里用codex的订阅。
但我看各路harness评测榜单好像都没有copilot,使用者声量也很小,想问问各位佬为什么会这样?copilot实际什么水平?Neptune (@Neptune1) 在 ccswitch加个fast统计应该不难,为啥官方不加呢? 中发帖
codex自己都能十几分钟自己搓出来,只用ccswitch数据外置的,当然也可以重新打包ccswitch
[image]Peng (@shzypenguin) 在 dsh 还挺好玩的? 中发帖
[Snapzy_2026-08-13_23-50-16_659]
[Snapzy_2026-08-13_23-51-23_621]
几句话就出来了,挺好玩的 😗夕阳大爆炸 (@ZhuBOM) 在 深夜福利,cursor密钥,登爆fb5!!! 中发帖
自己解码使用,只能用cursor cli
Y3Jzcl9mNGJkYjEzYTA1ZGUzZWVmOTUwMTQ1MGJhNWI2OGVhOGQyZTc3MjViYmMyOTg5NjY4YzE2OTk4MzA4NTliNjdl
用下面命令
$env:CURSOR_API_KEY=“密钥”前原圭一 (@vkolinkokokol) 在 DeepSeek-V4-Pro-0813重新上架 中发帖
maximo (@demouo) 在 学起来!完整版 DeepSeek Harness Prompts 中发帖
You are an AI agent powered by DeepSeek Harness.
The DeepSeek Harness implementation checkout is at /opt/homebrew/lib/node_modules/@deepseek-ai/dsh/. The checkout location and current working directory are separate values and may differ; never infer the working directory from this path. Use pwd to determine the current working directory. Use this checkout only to inspect or extend DSH itself.
...@sallyn 在 DSH · DeepSeek Harness 初体验 | 很有意思、优化不错,但需要等待社区生态发展 中发帖
[!tip] 本文并不算是技术文章,只是简单体验一下原生不装任何dsh plugin的情况下,dsh给我的感受
对MCP的支持
虽然在WebUI中找不到配置MCP的入口,但是实际上可以通过更改 ~\.dsh\profiles\web\cordis.patch.yml 这个文件来配置MCP,下面是我配置了一部分我常用的MCP,已脱敏处理。
# Your patch layer for this dsh profile, applied after every bundle layer:
# a top-level YAML array of loader patch entries (id-targeted config
# overrides, disables, and insert lists; `!!js` expressions allowed).
# Playwrigh...Nxty 在 DSH多agent调用简单测试 中发帖
使用的模型是grok 4.6
怎么说呢, 反正配置思考等级花了点时间, 然后确实可以调用多个agent,
sub agent默认是官key,很多地方都默认是官方key调用,这个用其他模型的话配置可能要花点时间
目前感觉没有很特别的地方? 注入的提示词比较长, 然后web界面有一个详细的可视化记录可以溯源,这样也许就可以详细了解gpt是怎么删光我的项目的了
[f1053526dfa019b79c533ff8cd241a7f]
[image]@shrimp1 在 论坛的cun.ai是骗子大家小心。 中发帖
我看论坛有很多人喷这个中转站,我这边先说一下他家都有什么站点:https://capi.cun.ai/ 、 https://wapi.wintoken.dev 下图是我与中转站客服的对话记录,他们有问题,不承认,不退钱。 现在搜了一下论坛,很多坛友都反馈他家有问题掺水等等。 我这里也提示一下大家吧。 希望别上当。
[2026-08-13_234029]刘作老虎 (@hsingjui) 在 dsh自定义供应商的一些配置 中发帖
用dsh的自定义供应商接了自己的newapi,发现模型没办法调整推理等级,就拉下来代码让ai分析了一下
结论就是编辑 ~/.dsh/settings.yaml,在供应商模型下加:
models:
- id: deepseek-v4-flash
reasoningEfforts:
off: # off = 关思考
max: max
#这里支持 off minimal low medium high xhigh max
保存即生效,不用重启,效果是这样的
[A06ABD4F-EEDC-476B-A3A7-D43BF955FAF9]
然后发现推理等级还有一个Default,看着多余
在供应商那里加上 reasoning: max //默认的推理强度,Default就没有了
还有就是设置模型支持多模态
models:
...@newwangshaofeng 在 分享1000刀grok4.5、grok4.6 (自己的站,非推广) 中发帖
分享1000刀grok4.5、grok4.6
自用站点,非推广,已禁用注册,直接用。
sk-M5EdtAU0iH0245z0R4Cy1AsJ4QGhWGdeuwYClnO0vlphkQrP
https://ai.xmin.top/v1
2h2g小水管服务器,大家测测降智了吗。
提示词: 创建一个HTML,内容是SVG绘制一个鹈鹕骑自行车的2D动画
[image]