@bbbZeroCat 近期部分请求计费异常的排查与处理结果 | 3 天国模免费用 | GPT 低至 0.08x 中发帖

各位佬友好,向大家同步一个近期的计费异常排查进展、技术复盘与处理方案。 
问题原因与技术详情
此前我们陆续收到部分佬友通过工单反馈,在特定场景下调用扣费偏高。经过团队排查日志与代码比对,确认是在处理涉及缓存读取的请求时,协议转换环节的两个历史逻辑缺陷叠加,导致缓存 Token 被重复计费。 
一、协议转换时未能正确剥离透明缓存 
当用户使用 Claude 协议接口调用非 Claude 模型时,系统需要将上游返回的用量换算为 Claude 格式。旧逻辑只在“存在显式缓存写入”时,才将缓存 Token 从总输入中扣除;而 DeepSeek、GLM、Kimi 等国产模型的机制属于自动透明缓存,通常只有缓存读取、没有缓存写入,导致原本包含缓存的“总输入”被系统错误地原样当作了全量的“全新输入”。 
二、响应转换过程中丢失了原始计费快照 
在响应转换环节,旧代码未能完整保留上游返回的原始计费信息,导...
 
 
Back to Top