OpenAI 针对 GPT-6 推出升级版提示词缓存系统。新系统默认具备更高的命中率,30 分钟内复用前缀最高可享 90% 费用折扣,并新增监控面板、未命中诊断、动态推理强度调整及缓存预热等功能。
GPT-6 让持久运行的 AI 智能体能够连续数小时处理复杂任务,如重构代码库、生成深度研究报告等。在长流程任务中,API 会频繁发出相互承接的请求,通常沿用上一轮的系统指令、工具定义和上下文。
OpenAI 针对 GPT-6 推出了全新升级的提示词缓存(Prompt Caching)系统。新系统默认具备更高的缓存命中率,符合条件且在 30 分钟内复用的共享前缀可享受最高 90% 的输入 Token 费用折扣,同时大幅缩短响应时间。
新上线的提示词缓存控制面板支持实时监控缓存命中率随时间的变化,并提供输入构成图表,直观对比已缓存与未缓存的 Token 消耗,帮助开发者快速发现缓存命中率下跌并评估代码变更的影响。
针对意外的缓存未命中,OpenAI 提供了提示词缓存诊断工具。该工具可将当前请求与近期响应进行对比,准确定位阻碍复用的变更点(如工具定义、模型或设置微调),并输出受影响的 Token 估算值,方便针对性优化:
{
"prompt_cache_diagnostics": {
"type": "cache_miss",
"reason": "tools_changed",
"comparison_reusable_tokens": 5629,
"cache_missed_tokens": 5629
}
}
除了底层默认优化外,OpenAI 还开放了一系列面向工作负载的细粒度控制功能:
configuration_update 保持请求级强度一致,即可让简单追问低消耗、复杂任务深推理,同时完整保留上下文。allowed_tools 过滤或将 tool_choice 设为 none,而不是直接删除工具定义;新指令则建议以追加方式放在上下文末尾。免费获取企业 AI 成熟度诊断报告,发现转型机会








关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断