liu (@BW_liu) 在 「提示词已死」追求更好的模型吧 中发帖

最近一个月我密集调了很多模型:MiniMax、千问、GLM、DeepSeek、Kimi,还有 GPT 和 Opus 5.5。一开始我还是老习惯,想用提示词把它们掰正。掰到后面才发现,每个模型都有改不掉的固有性格。 
用过 MiniMax 的人大概都能感觉到,它经常就是蠢,提示词堆再厚也没用。GPT 则总是找不到重点,把任务做完就收工,做对 比 做好 更重要。DeepSeek 等 Flash 模型则喜欢雷霆大思考:答案已经在手里了,还是要 wait,再绕一圈,浪费时间。以及一些通病比如爱用比喻——药、砍、账、柱、刀 … 
其实最后的最后,压垮我,让我震惊瘫坐的是 Opus 5.5。大家都知道它做视频非常厉害,Opus5.5 会主动把视频一帧一帧看过去,自己发现渲染问题,自己去修。它还有品位,想给使用者一个惊喜,而不是交一份及格的,勉强满足约束的东西,它真的像一个想把事情做对的协作者。那么你说...
 
 
Back to Top