@Infty降智众说纷纭,不如来看看Openrouter的api请求的6 sol和6 luna! 中发帖

鹈鹕测试: 
gpt-6-sol-low:轮子飞上去了!! 
 [image] 
gpt-6-sol-max:小Astra! 
[image] 
gpt-6-luna-max:也还可以 
[image] 
糖果题: 
gpt-6-sol-low:29忽略手感 
 [image] 
gpt-6-sol-max:21正确 
[image] 
gpt-6-luna-max:也是不对的 
[image] 

其实鹈鹕测试这种东西,因为大家codex提示词不同,记忆不同,LLM本质还是在空间采样,从输入条件下的输出分布中生成,有一些差异是正常的,除非非常离谱,不然难以通过鹈鹕判断降智,当然这个6-sol-low也确实离谱. 
当然更准确的还是去sub2api或者cpa去看实际请求模型,上面只用Openrouter的api给大家作参考. 
我手上有4个降智的号,我最近也一直在找攻克方案.手上唯一还正常...
 
 
Back to Top