https://linux.do 论坛的话题更新通知频道。
LI (@shisan1231) 在 opencode-go已经更新 dsv4flash 正式版 中发帖
直接询问 “不使用联网工具,第25界冬季奥林匹克运动会举办的时间和地点”,dsv4flash在美誉调用联网工具的前提下的回答完全正确。这说明dsv4flash正式版的知识库起码已经更新到26年2月 [7b93c95631a8c08ffea21b57174b7b52.png]@sallyn 在 你大D老师是瞎不是傻 | DeepSeek-V4-Flash GA 生成的咖啡馆宣传网站 中发帖
[!warning] 代码部分全程由DeepSeek-V4-Flash GA编写,Gemini仅提供识图功能,GPT仅提供生图功能。
直接看效果
https://shanyu-cafe.netlify.app/
前置要求
一个可以看图的MCP(我接入的gemini-3.6-flash)
一个可以生图的MCP(我接入的gpt-image-2)
一部分skill(见代码块下方图片)
我的CLAUDE.MD文件
## 联网搜索相关
优先使用原生的`WebFetch` 和 `WebSearch`。当你的原生 `WebFetch` 和 `WebSearch` 失败之后,可以尝试使用 EXA MCP 的进行代替。
## 视觉能力
你是一个没有视觉能力的模型,不要尝试去直接看图片,会报错。需要看图的时候,可以使用MCP中支持看图的MCP。
## 生图能力
你本身没有生图能力,但是...@chenxin 在 建议GLM用户转用Deepseek吧 中发帖
众所周知GLM涨价了,我是去年9月份购买的老套餐的,但是因为没有订阅续订,几乎没有任何补偿,而且中间也存在模型的一系列问题,之前开放过退款渠道,也提交了退款但是并没有处理,那我就用吧,随着这次涨价我也看明白嘴脸了,也建议不要使用zcode,非常难用。
deepseek新推出的flash也挺好用的,看了一下X,评分貌似是超了GLM5.2,既然不考虑C端,但是梁圣却一直在做普惠,该选什么不用说了吧。
[image]江洋大盗 (@jiy29104983) 在 bybit eu 要录取通知书或 在读证明怎么处理啊 中发帖
佬们,bybit eu 的账户下来了,申请卡的时候卡在这里了,这个有没有有经验的?怎么搞一个啊😫
[IMG_7094]大星.派 (@THH) 在 程序员未来的出路在哪里 中发帖
现在越来越多的模型越来越厉害了,我总是感觉挺担忧的,因为还在去年cursor出之前,ai只是对话式,结果当curosr这样的工具再加上claude3.5sonnet就已经能够胜任一些开发工作,到现在也就一年时间发展,用一般的模型就能够基本覆盖我的全部开发场景,感觉现在技术也不是护城河,我刚毕业就能够靠ai维护几个项目了(勿喷),自己的技术已经退化到连sql都写不出了,想当初感觉天天通宵写代码的时间放到现在来看根本不值一提。
发这个帖子的起因是因为我朋友同样和我一起毕业学的旅游管理考的导游证,他现在一天收入基本上就是400-7,800不等,他甚至连实习都没有过,我当时大三就各个大城市跑,我加班一天连他的一半都赶不上,现在大环境不好,工作难找,而且ai冲击这么大,我感觉对未来都一片黑暗了,以前程序员还有引以为傲的技术,但是现在这个优势在慢慢走向消亡@Leooooo 在 DeepSeek V4 Flash 测试 问题 求助 中发帖
[0993d61b35ee82fcac8f1e15cd1b698e]
构建 测试 只答应 实际不跑,佬们,这是什么问题?小夜 (@xiaoye6688) 在 杭州现在的太阳好红!!! 中发帖
[c43eee4f94e8cab29b4da006bad253fd]
[db3f355cb8fc33a6cd7c6b6d7b254fad]@hsiaoshwai 在 免费麦当劳麦辣鸡腿堡 任意消费20元使用 中发帖
免费麦当劳麦辣鸡腿堡 任意消费20元使用
这个活动大家可以免费领取一下哦
任意消费20元可以随单一起使用,7天有效期
微信打开下方地址 领30万份麦辣鸡腿堡
#小程序://麦当劳/j1mqz67g7iG4mYw
口令:A或B或C 任意一个字母
[c99fc559b04fccad7083bbdaedde9cd1]你这是违法行为 (@Anano) 在 模型自称Claude不等于蒸馏,1000条回答就能让Qwen认错自己! 中发帖
研究者 Ziqian Zhong 让 Claude、GPT-4o 等模型回答 1000 个普通问题,再删掉其中所有模型名和公司名。他随后用这些问答材料微调 Qwen、DeepSeek 等开源模型。
训练后,部分模型开始认错自己的身份。Qwen3.5-397B-A17B 原本只有 0.6% 的回答自称 Claude。用 Claude 的回答训练一轮后,这一比例升至 40.3%。
Ziqian Zhong 的解释是,这些模型在预训练时看过大量 Claude 的对话和介绍,已经把某些表达习惯与「Claude」联系起来。微调让 Qwen 学会了这种说话方式,被问到身份时,也更容易回答自己是 Claude。
为验证这一点,他用 GPT-4.1-mini 把 Claude 的回答改成粗糙的简单句,回答内容基本不变,但语气和排版不再像 Claude。再用这批材料微调后,3 个模型中有 2 个几乎不...慕鸢 (@user792) 在 【蓝色大肥鱼竟敢吃白饭】 中发帖
ds v4没发布时:金融吸血鬼的谎言泡沫即将破裂
v4 预览版发布时:deepseek的新一代大模型发布,但代价是什么?
v4 预览版承认由于gpu产能导致现在自己价格虚高时:一颗新星正在冉冉升起
v4 预览版打二五折时:开源界的英雄正在拯救闭源的黑暗ai界
v4预览版宣布命中缓存输入打1折时:德技双馨的老企业家梁文峰再攀高峰
v4预览版宣布25折永久保留时:伟大的梁圣和他的大赢鲸莅临ai界
v4 正式版迟迟不出时:爱梁,信梁,等梁
v4宣布涨价:蓝色大肥鱼竟敢吃白饭,
v4正式版跳票:小难梁掏不出大赢鲸
ds官方未就跳票做出解释:大wait die梁子重新定义七月中旬,ds的神话还能持续多久?
gpt luna降价:新一代斩杀线正清算被背信弃义的伪朝
v4 flash 0731发布:亿万鲸子清算!对所有AI企业后门进行深度求索!你这是违法行为 (@Anano) 在 推理引擎WASTE开源:把Kimi K3完整跑进64GB MacBook 中发帖
边缘数据库公司 SQLite AI 开源推理引擎 WASTE。它让保留全部层和专家的 Kimi K3,能在一台 64GB MacBook Pro 上运行。转换后的模型约占 1TB,速度为每秒 0.49 至 0.54 个 Token。
WASTE 把约 27GB 的模型主干留在内存。8 万多个专家放在内置 SSD。每生成一个 Token,只从硬盘读取当前调用的专家。
这个版本没有蒸馏、裁剪或删除专家。WASTE 将原本采用 MXFP4 的专家权重重新量化到 3-bit,并把模型主干压成 4-bit 和 8-bit。
[image]会飞的蹦蹦 (@hupc) 在 DeepSeek Flash V4正式版在CC中无敌好用啊 中发帖
今天正式版出来后,就用官方API接入cc中开始干活,不到4个小时 ,差不多消耗了1亿token,缓存命中率竟然达到了99%
关键是干活质量还不错,很少返工
真不错 😊
[image]LLMeme 在 DeepSeek V4 Flash 顶破 GPT-5.6 Luna 直观示意图 中发帖
今天凌晨,Sam Altman 兴奋地宣布了 GPT-5.6 Luna 降价,给出了这张图:
[IMG_1798]
后来的事情大家也知道了, Artificial Analysis 给
DeepSeek V4 Flash 0731 最新的评测结果是:
[image]
所以,如果把这个结果叠到 Sam Altman 的原图上,就会得到:
[model-evolution-annotated-python]
因为原 X 还有网友指出 Sam Altman 有意无意漏了一些模型,我顺便也加了几个。
顺便一提,我试图直接在 ChatGPT 合成上面这张图,结果要返工好几次才能生成 DeepSeek 顶破 GPT 的结果,也是醉了(最后为了准确,要求写 Python 制作图片)
[eb6eddb5-1be5-4bff-96a9-c8402a934684]