Hao (@haowang) 在 gpt 偶发性降智确实存在 中发帖

1:15 3:15 5:15 7:15 的糖果测试都正确 
9:15 三次测试全部错误 
9:31 复测又全部正确了 
当然 6.1-sol 偶尔答不对糖果题是有可能的,这种时候一般会回答 29,因为 29 是忽略凭手感选择形状这个条件下的陷阱答案。而 9:15 三次错误回答都不是 29,而是 27、28 这种毫无逻辑的答案,跟 5.6-luna 的行为一致 
因此这更像是偶发性降智路由,而非大模型的不确定性 
 [image]
 
 
Back to Top