GPT-6 Astra支持无损换挡:长对话切思考强度不再打掉缓存
发布时间:2026-09-05
动察 Beating AI 快讯,OpenAI 给 GPT-6 Astra 新增 configuration_update。在 Responses API 的同一段长对话里,现在可以随时调高或调低 reasoning effort,又不改写已经缓存的 Prompt 前缀。难题切 High、xhigh,简单任务再降回 Low,前面的长上下文还能继续复用。以前这是个很隐蔽的烧钱坑。reasoning effort 会作为上下文开头的指令,中途切到新的思考档位,会导致大量缓存无法继续复用。有 Codex 用户实测,切换档位后缓存命中率曾从 98.5% 掉到 65%,下一轮重新建立缓存后才恢复到 97% 以上。对长时间运行的 Agent 来说,这个改动很实用。碰到难题可以临时拉高思考强度,简单任务再降回来,不会只因为换挡,就让前面几十万 Token 的缓存重新按普通输入处理。----------缘辉旺盾网量化工具温馨提示:数字货币投资有风险,入市需谨慎;本文章不作为投资依据,仅供参考----------交流群:https://t.me/dunwangyuanhuiwang

动察 Beating AI 快讯,OpenAI 给 GPT-6 Astra 新增 configuration_update。在 Responses API 的同一段长对话里,现在可以随时调高或调低 reasoning effort,又不改写已经缓存的 Prompt 前缀。难题切 High、xhigh,简单任务再降回 Low,前面的长上下文还能继续复用。


以前这是个很隐蔽的烧钱坑。reasoning effort 会作为上下文开头的指令,中途切到新的思考档位,会导致大量缓存无法继续复用。有 Codex 用户实测,切换档位后缓存命中率曾从 98.5% 掉到 65%,下一轮重新建立缓存后才恢复到 97% 以上。


对长时间运行的 Agent 来说,这个改动很实用。碰到难题可以临时拉高思考强度,简单任务再降回来,不会只因为换挡,就让前面几十万 Token 的缓存重新按普通输入处理。

----------缘辉旺盾网量化工具温馨提示:数字货币投资有风险,入市需谨慎;本文章不作为投资依据,仅供参考 ----------交流群:https://t.me/dunwangyuanhuiwang