f14xuanlv各厂商缓存命中条件 中发帖

想问一下各位佬,缓存计费是跨模型适用的吗,主要是想询问类似这个场景: 
假设我一个窗口有很多上下文且缓存过期了,我想在这个窗口继续任务,我可以切换到一个便宜模型比如 GPT-5.6 Luna 触发一次对话,存入缓存,然后再切换到贵的模型比如 GPT-5.6 Sol,以命中缓存的姿态继续对话吗?如果可以,这样 GPT-5.6 Sol 这次的调用,缓存命中率就很高了,能省下不少额度。 
可能各厂商机制略有不同,佬们能分享自己熟悉的 Code Agent 这方面缓存命中机制就好了 :tieba_013:
 
 
Back to Top