GPT-6 Astra支持无损换挡:长对话切思考强度不再打掉缓存
- GPT0%
- Token+22.16%
动察 Beating AI 快讯,OpenAI 给 GPT-6 Astra 新增 configuration_update。在 Responses API 的同一段长对话里,现在可以随时调高或调低 reasoning effort,又不改写已经缓存的 Prompt 前缀。难题切 High、xhigh,简单任务再降回 Low,前面的长上下文还能继续复用。
以前这是个很隐蔽的烧钱坑。reasoning effort 会作为上下文开头的指令,中途切到新的思考档位,会导致大量缓存无法继续复用。有 Codex 用户实测,切换档位后缓存命中率曾从 98.5% 掉到 65%,下一轮重新建立缓存后才恢复到 97% 以上。
对长时间运行的 Agent 来说,这个改动很实用。碰到难题可以临时拉高思考强度,简单任务再降回来,不会只因为换挡,就让前面几十万 Token 的缓存重新按普通输入处理。
來源:BlockBeats
免責聲明:當前內容均來自第三方觀點或由AI直接翻譯第三方觀點,CoinEx不保證內容的真實性、準確性和原創性,不構成CoinEx相關的任何投資建議。數字資產價格波動劇烈,請注意潛在風險。
熱搜榜
- 幣種價格24H漲跌