ktze 在 kimi官订k3和k3-256k同样max推理等级,思考深度却不一样?糖果问题,k3-256总是更容易提前放弃直接回答29 中发帖
只截图了zcode,但实际上我在kimicode和pi里也试了,情况差不多。
glm5.3和k3差不多,大部分情况下会坚持多推理一会儿(当然也不是100%),然后给出正确答案。均为官订。
k3-256几乎总是提前放弃。
感觉虽然同为max推理,推理深度(Reasoning Token预算)完全不一样
[image]
[image]
[image]