OpenAI 宣布 GPT-5.6 系列降价:Luna 降价 80%,Terra 降价 20%。同时推出 Fast 模式,Sol 模型处理速度最高提升 2.5 倍。这些更新源于模型自身优化,让企业以更低成本获得更高性能。

昨天,OpenAI 分享了 GPT-5.6 如何通过自我优化变得更高效。今天,这些成果已经传递给用户——GPT-5.6 Luna 和 Terra 的 API 价格下调,同时 GPT-5.6 Sol 的响应速度大幅提升。这些更新意味着,企业投入 AI 的每一分钱都能获得更多回报,在需要快速响应的场景中也能跑得更快。
从即日起,GPT-5.6 Luna(最快、最经济的模型)降价 80%;GPT-5.6 Terra(适合日常工作的均衡模型)降价 20%。在使用 Codex 和 ChatGPT Work 时,付费订阅的用量计算也已同步调整。Luna 让企业能够以极低成本处理大批量高质量任务,支持工具调用和多步骤工作流,使更多 AI 应用具备规模化落地的可行性。
让先进智能更丰富、更可负担,是 OpenAI 使命的核心——确保 AGI 惠及全人类。这次调整正是这一承诺的实践,背后是多年模型构建、服务和部署优化的积累。
API 同时全新推出 Fast 模式,取代原有的 Priority Processing。针对 GPT-5.6 Sol,Fast 模式比标准处理速度快 2.5 倍,价格翻倍但智能水平不变。Fast 模式向后兼容,标记为 priority 的请求会自动启用。
1 of 6
高效使用 AI 始于明确目标。任务的重要性、错误成本、紧迫性和规模,决定了智能、速度、可靠性和成本之间的最佳平衡。这种平衡在同一个工作流的不同步骤中也会变化。
GPT-5.6 系列给企业提供了更大的优化空间。Luna 的性能与一年前的旗舰模型相当,但每任务成本仅为其 6%(约 6 美分),速度提升近 9 倍。在 Agents' Last Exam 等专业测试中,Luna 的表现优于 Fable 5,且每任务估算成本低近 99%。
实际操作中,企业可以先定义所需的结果和质量标准,然后通过评估判断:哪些环节需要更强的智能才能显著改善结果,哪些环节使用更快、更低成本的模型也能达到相同品质。例如,一个编程工作流可能先用 Sol 解决不确定性、制定方案,再让 Luna 执行明确的代码改动、编写和运行测试、评估结果。其他工作流则可能需要不同的搭配。
GPT-5.6 系列拓展了这些选择的范围。企业可以在每个环节应用最大程度的实用智能,同时为创造的价值支付合理的价格。
要实现这种灵活性,关键在于让模型背后的每一层都更高效。
OpenAI 的效率优势来自三方面的改进:模型本身、运行模型的推理系统、以及连接工具和上下文的智能体框架。GPT-5.6 模型能以更直接的路径完成任务;更好的路由策略让硬件始终高效运转;优化的生产软件生成 token 效率更高;智能的上下文管理帮助智能体避免重复已完成的工作。这些改进共同实现了用同等算力完成更多有效工作,从而减少每次结果所需的时间、token 和成本。
GPT-5.6 Sol 越来越擅长独立发现并交付下一轮效率提升。在人工主导的流程中,Sol 自主重写并优化了生产级内核,设计了数百次实验来改进 token 生成,并监控训练过程、在出现问题时主动干预。内核优化使模型端到端服务成本降低了 20%,而实验使 token 生成效率提升了 15% 以上。这项工作仍在继续,形成了一个更紧密的反馈环:模型能力越强、自主性越高,提升效率的速度就越快。详细了解 GPT-5.6 背后的工程细节。
要满足对丰富智能的需求,既需要更多算力,也需要更有生产力的算力。OpenAI 正在构建弹性基础设施组合,将每个工作负载分配给最合适的系统。这一策略同时覆盖性价比曲线的两端:在低成本端,Luna 和 Terra 的新价格让大规模高吞吐任务变得经济可行;在前沿端,Fast 模式让 API 客户在响应时间要求高时能更快调用 Sol。
企业可以将更多 AI 引入日常运营,而不牺牲最关键任务的执行速度。大规模文档分析、客户交互分类、常规代码实现等任务可以广泛经济地运行,而复杂的 Sol 负载在需要快速响应时也能跑得更快。
这些收益可以持续放大。在人工主导的流程中,更强的模型帮助技术人员找到下一轮改进,缩短实现更好性能和更低成本的路径。OpenAI 的战略始终聚焦于同时推进能力和效率,使每一代智能都能以更低成本完成更多工作。
GPT-5.6 Terra 和 Luna 继续在 ChatGPT Work、Codex 以及 OpenAI API 中提供。在 ChatGPT Work 和 Codex 中,Free 和 Go 用户可使用 Terra,Plus、Pro、Business 和 Enterprise 用户可选择 Terra 和 Luna。
自 7 月 30 日起,API 定价为:Terra 输入 token $2/百万,输出 token $12/百万;Luna 输入 token $0.20/百万,输出 token $1.20/百万。Sol 定价不变。ChatGPT 和 Codex 订阅价格及配额预算不变,但 Terra 和 Luna 的使用将消耗更少的额度。定价变更将于今天晚些时候在 AWS 上逐步推出。
GPT-5.6 Sol 的 Fast 模式已取代 API 中的 Priority Processing,并与 Codex 中的 /fast 一致。现有标记为 priority 的 API 请求将继续正常工作。查看完整的 API 定价详情。
原文链接:OpenAI Blog
本文由前途科技编辑整理
免费获取企业 AI 成熟度诊断报告,发现转型机会
关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断