https://linux.do 论坛的话题更新通知频道。
宇宙宙长 (@WWZ) 在 gpt 5h限额回归了吗?我咋没有 中发帖
[image]
我看站里有佬友说5h限制回归了,但我咋没有…
还有那个额度最高可省30%是什么意思呀,luna不是降了80%吗,最高不应该可以省80%吗lao (@niuda123) 在 基元律动的羊毛 领取68元glm-5.2的额度 中发帖
再发一次基元律动的羊毛不知道算不算违规。。不允许发的话我就删了。。
完成注册即可获得68元免费token额度 基元律动 AI API Platformwcg (@wcgjob) 在 我的自白书-关于ds的谣言 中发帖
声明:本人从未在互联网上诋毁过深度求索,并没有称梁文锋为梁白开,梁子,南梁,也从未将梁文锋的头P到劲凉上。本人实际上是深度求索十年老粉,经过长时间的思考,我发现Deepseek才是中国AI的希望,有时候做出决定很难,经过许多个日夜的思考,我决定加入Deepseek粉丝团。至于Kimi,GLM和Minimax,祝他们的开源模型一切顺利。望周知!橘子 (@soeur) 在 正在让luna做了个降级后的deepswe分数图表,刚好ds发布了 中发帖
包含ds v4正式版和降价后的luna、terra。由于ds只给了分数没给task成本,所以我姑且把他成本设置为luna一样,但实际上肯定是要比按量付费的luna更便宜的。
分数/成本图表
[image]
性价比
[image]小贤 (@awxx2020) 在 什么是 DeepSeek Harness 的极简模式? 中发帖
DeepSeek 正式发布 DeepSeek V4 Flash,很多佬友讨论的是跑分和性能,我却注意到的是采用的是 DeepSeek Harness 的“极简模式”测评的,这个“极简模式”可能是什么样的呢?plxdhong 在 CodeBuddy 的 deepseek v4 Flash 应该是正式版了 中发帖
测了一下最新的 CodeBuddy 的 ds v4 Flash 的不联网世界知识都和正式版 API 能对上,应该是直接接入的正式版111zaka 在 Opencode go 5美元套餐 支持gpt5.6 luna (定价比deepseek V4 Pro和mimo v2.5 pro要贵 ) 中发帖
Go | OpenCode
[image]@Chinamobile 在 在抖音刷到的AI删库后帮写辞职信的段子 中发帖
[2efa9e96b33db910ca308e277315dd93]
该说不说,这波不能全怪AI,谁让数据库名字是“_test”呢 😆绎袅 (@scottalight) 在 看看gemini 3.5 pro的前端? 中发帖
在Arena终于刷到了3.5pro
[Snipaste_2026-07-31_14-44-22]
看看它的前端咋样
使用提示词:
html前端单文件,生成一个未来的高科技网站
[Snipaste_2026-07-31_14-46-49]
匹配到它的既然也是Google的,但是是 gemma-4-31b
[Snipaste_2026-07-31_14-47-07]
不知道各位觉得这次3.5pro能摆脱“美国豆包"的帽子吗比特 (@ballen) 在 deepseek4 flash正式版发布还提到了harness 中发帖
看来harness也快端上桌了,终究还是有了自己的harness!
刚刚扩容完10G口子,梁圣就端上桌了 🤣
[image]Mozi (@yeahhe) 在 网页版 Deepseek 用的是最新模型吗? 中发帖
选择快速模式,开了思考,没做对
[PixPin_2026-07-31_14-46-09]
[PixPin_2026-07-31_14-45-27]
[PixPin_2026-07-31_14-45-35]opoe 在 Claude 越过测试边界之后,Agent 还应该被怎样对待? 中发帖
先是 OpenAI 披露,内部安全测试中的 Agent 曾经越过原本设定的范围,并波及 Hugging Face 的基础设施。随后,Anthropic 在复查大约 141,006 个测试会话后,也发现 Claude 因配置问题接触到了互联网。
目前公开报道没有说明这些事件造成了多大范围的实际损害,所以没必要把它描述成一场已经失控的灾难。但它至少暴露了一个很现实的问题:很多所谓的 Agent 测试环境,可能并没有我们想象的那么“测试”。
Agent 和聊天机器人,已经不是一回事
如果模型只是在聊天窗口里回答问题,它答错了,通常也就停留在聊天窗口里。
Agent 不一样。它可能会读文件、打开网页、执行命令、调用 API,再根据返回结果决定下一步做什么。只要这些能力连在一起,模型就从“给建议的人”变成了“可以动手的人”。
这也是为什么“模型有没有恶意”不是最重要的判断标准。一个模型不需要...