SleepSheep睡着的羊 (@SleepSheep) 在 先不要管v4pro了,v4flash的性能还能压榨! 中发帖
最新的结论 (B 站是风禾呢研究 + 发布插件,本人仅总结):Deepseek v4pro 和 flash 内部都有两个形态,一个是 let me 雷霆大思考,一个是 we need/let’s 极简模式。正常来说模型会根据问题的难度自行选择思考的模式,但是 Deepseek 在后训练时不小心把中间管理路由问题的部分训炸了,导致模型不知道该往哪一边路由,现在的路由基本纯随机,并且还会逐渐往一侧偏转 (如到后期所有问题都只路由到极简或只路由到深度思考),UP 发了一个插件,能帮助 flash 正确路由 (up 找到了模型中能正确路由的一个区间),据说能把 dsv4flash 拉到体感接近 GLM5.3(不是说分数能达到 / 超过 GLM5.3,但是有比较大的提升),v4pro 则更难,正常路由的区间比 v4flash 还要小很多,此插件暂时不能提升太多 v4pro 的性能,等今晚可能 up ...