lucas (@lucasli)来个astra tips: 如何在codex gpt-astra对话过程中切换思考深度而不丢失缓存 中发帖

直接上方案,config.toml中添加: 
[features] 
reasoning_effort_override = true 
验证: medium 聊一轮 → high 聊一轮 → low 聊一轮。 
全程保持同一个模型、同一个会话,避开上下文压缩。 
然后把这段话交给本地 Codex: 
“读取刚才测试会话的日志,检查是否出现 configuration_update;按请求列出思考档位、输入 tokens、缓存输入 tokens 和缓存比例。重点比较切档后的第一次请求,不要用整个会话的累计比例代替。日志缺失的字段请直接标明。” 
看到开关为 true,只代表配置开启。看到 configuration_update,说明客户端已发送更新。
 
 
Back to Top