@xianaldai 在 关于部分国产新模型的一些看法和建议 中发帖
近月来,国内多家公司的最新模型相继发布,实在是可喜可贺。
因此我也是蹭了些模型去尝试了这些模型的能力。以下内容带有主观感受,并且由于钱包原因,部分厂商模型没能进行体验,因此无法列入讨论。
首先先说说deepseek,这算是我用的第二久的的国内模型了。
新上的deepseek-v4-flash正式版的功能相对于预览版有了极大的进步,我觉得表现在以下几个方面:
长上下文的稳定性。在810k的上下文下,deepseek依然表现很稳定,在max的思考强度下上下文召回率相较于v4-pro-preview更高,且不容易胡言乱语
定价相当的便宜,官方的定价在缓存命中(缓存读取)的情况下非常的便宜,中等强度使用钱包压力不大
deepseek的tool call比较稳定,不容易出大问题
补充一点:如果你看到某家的flash总是飙一些你看不懂的语言,还时不时岔开话题自言自语,或许他家用的是英伟达渠...