aerolink (@mingzz) 在 GPT降智探讨 中发帖
从
继续
这个方法应该是确认不准确的,但绝对是降智了,感觉可能是一个比较好的量化版本导致的?
测试环境:
ip环境:azure美国机房,华盛顿
浏览器:普通chrome和edge
测试结果:
使用长期登录老号(team母号,权重高)测试:
选择高挡位:表现正常
[image]
选择中挡位:能回答超出知识库时间的问题
[image]
使用子号结果相同。
使用新注册的子号来做测试:
高挡位:多次测试有时和母号行为一致,有时回复2024,但能通过糖果测试
[image]
极高挡位:2024
[image]
使用codex2api v2.9.0反代测试:
gpt5.6全系列均回复June 2024,但依然可以答对
[image]
因此做以下合理猜测:可能这是一个量化版本,然后量化导致了这个时间不正常?但量化程度不高,导致实际能力影响不大?