前途科技前途科技
  • 服务
  • 关于
  • AI
    • AI 大模型
    • 具身智能
    • 算力芯片
  • 科技
    • 智能终端
    • 软件·互联网
    • 汽车·出行
    • 科学前沿
  • 资源中心
    • 深度研究
      • AI 前沿
      • 教程
      • AI 知识库
      • 案例研究
    • 行业报告
      • 白皮书
      • 行业报告
      • 研究报告
      • 技术分享
      • 专题报告
    • 精选案例
      • 金融行业
      • 医疗行业
      • 教育行业
      • 零售行业
      • 制造行业
  • 服务
  • 关于
联系我们
产品/09.23 · 07:01/4 MIN/0 阅读

OpenAI 发布 GPT-6 Sol 与 Luna:性能比肩旗舰,API 降价 50%

OpenAI 拓展 GPT-6 家族,正式推出主打高性价比的 GPT-6 Sol 与 Luna。两款模型承袭 Astra 的核心能力,在专业工作、代码编写和电脑操作等基准中表现出色,API 价格较上一代直降 50%。

继月初推出旗舰模型 GPT-6 Astra 之后,OpenAI 宣布进一步拓展 GPT-6 产品线,正式推出两款全新模型:GPT-6 Sol 与 GPT-6 Luna。

两款模型采用了与 GPT-6 Astra 相似的训练方法,将 Astra 在专业工作、真实性、代码编写、电脑操作(Computer Use)及对齐能力上的技术突破,移植到了运行更快、成本更低的模型上。

得益于缓存技术与推理架构的改进,OpenAI 将服务成本的下降直接让利给开发者:Sol 与 Luna 的 API 价格较 GPT-5.6 促销价直接腰斩,降幅达 50%。

API 价格调整一览

  • GPT-6 Sol:输入每百万 Token 为 2 美元(原 GPT-5.6 Sol 为 4 美元);输出每百万 Token 为 10 美元(原 20 美元),整体降价 50%。
  • GPT-6 Luna:输入每百万 Token 为 0.10 美元(原 GPT-5.6 Luna 为 0.20 美元);输出每百万 Token 为 0.50 美元(原 1.20 美元),整体降价 50%。

旗舰级 GPT-6 Astra 依然是各领域能力最强的顶级模型,适合对效果有极致要求的任务。

全面进化的基准表现

专业工作流程
在衡量跨应用商业流程的 AutomationBench 1.0.6 基准测试中,超高思考强度的 GPT-6 Sol 表现超越了极限强度的 Claude Opus 5,而单任务成本仅为后者的 9%。在多智能体复杂工作流评估 Agents' Last Exam 中,GPT-6 Sol 极限强度的得分达到 56.4%,超越 Claude Opus 5 的最高表现,任务成本降低 60%。

真实性与减少幻觉
在基于用户报错的真实对话评估中,GPT-6 Sol 的错误率较上一代减少了约一半,以更低成本达到了接近 Astra 的可靠性。GPT-6 Luna 在高思考强度下,则以约百分之一的成本追平了 GPT-5.6 Sol 的真实性水平。

代码编写与工程实践
随着 AI 智能体在代码领域的深度应用,日常 Token 消耗急剧增加。在评估代码能否直接合并至真实仓库的 FrontierCode 测试中,GPT-6 Sol 追平了高强度 Claude Fable 5.1,成本显著降低。在真实软件工程评测 DeepSWE v1.1 中,极限强度的 GPT-6 Sol 取得 68.8% 的成绩,紧逼 Claude Fable 5 的最高分(69.9%),单任务成本降低约 80%。

电脑操作
在评估 AI 智能体长程电脑操作能力的 OSWorld 2.0 离线测试中,GPT-6 Sol 达到 60.5% 的得分,与 Claude Opus 5(60.3%)持平,但任务成本低了约 80%。

提示词缓存与智能体优化

配合低廉的 Token 价格,OpenAI 对 GPT-6 的提示词缓存机制进行了升级,默认提供更高的缓存命中率。读取已缓存的输入 Token 可享受 90% 的折扣。

此外,OpenAI 推出了多项优化功能:

  • 监控与诊断:上线提示词缓存控制台与诊断工具,直观展示缓存比例并辅助排查未命中原因。
  • 动态调整不破缓存:开发者可在对话中根据任务难易动态调整推理强度或启用/禁用工具,这些操作均不再会打断先前的缓存上下文。
  • 显式断点设置:允许开发者自主设定前缀缓存终点,精准控制复用逻辑。

模型上线与支持范围

GPT-6 Sol 与 GPT-6 Luna 即日起在 ChatGPT Work 和 Codex 中向 Plus、Pro、Business、Enterprise 及 Edu 用户开放。免费及 Go 用户可通过桌面端体验 GPT-6 Luna。在 OpenAI API 中,两款模型对应的调用标识分别为 gpt-6-sol 和 gpt-6-luna。

标签:OpenAI大语言模型AI 智能体

想了解 AI 如何助力您的企业?

免费获取企业 AI 成熟度诊断报告,发现转型机会

置顶文章

tokenizers v1 最高快 30 倍,中文却只快 6.8 倍
置顶

tokenizers v1 最高快 30 倍,中文却只快 6.8 倍

亚马逊封杀 Meta Muse:问题不在 AI 购物,在浏览器跑在谁的机器上
置顶

亚马逊封杀 Meta Muse:问题不在 AI 购物,在浏览器跑在谁的机器上

前途科技前途科技
服务关于快讯技术商业报告
微信咨询二维码

咨询微信

扫码添加微信咨询

前途科技微信公众号

微信公众号

扫码关注

Copyright © 2026 AccessPath.com, 前途国际科技咨询(北京)有限公司,版权所有。|京ICP备17045010号-1|京公网安备 11010502033860号|隐私政策|服务条款
美军险些登临中国货船:出问题的不是 AI 幻觉,是那第二次调用
置顶

美军险些登临中国货船:出问题的不是 AI 幻觉,是那第二次调用

//

24小时热榜

字节跳动获296亿美元银团贷款,重金押注AI军备竞赛
TOP1

字节跳动获296亿美元银团贷款,重金押注AI军备竞赛

OpenAI公布第三方AI安全评估的四大重点与七项原则
TOP2

OpenAI公布第三方AI安全评估的四大重点与七项原则

3

虎鲸文娱发布鲸锐AI:打造全链路影视制作系统

16小时前
虎鲸文娱发布鲸锐AI:打造全链路影视制作系统
4

15999元折叠屏:中国精密制造的“升舱”时刻

17小时前
15999元折叠屏:中国精密制造的“升舱”时刻
5

爆火的FDE,为什么救不了中国企业的AI落地?

21小时前
爆火的FDE,为什么救不了中国企业的AI落地?
6

Expedia 接入 Meta Muse 智能体:可直接预订行程

48分钟前
Expedia 接入 Meta Muse 智能体:可直接预订行程
7

OpenAI 发布 Astra for Law:法律专属 AI 基础平台

8小时前
OpenAI 发布 Astra for Law:法律专属 AI 基础平台
8

MIT科技评论:这个夏天的 AI 热点,大多经不起核实

8小时前
MIT科技评论:这个夏天的 AI 热点,大多经不起核实
热门标签
大模型AgentRAG微调私有化部署Prompt EngineeringChatGPTClaudeDeepSeek智能客服知识管理内容生成代码辅助数据分析金融零售制造医疗教育AI 战略数字化转型ROI 分析OpenAIAnthropicGoogle

关注公众号

前途科技微信公众号

扫码关注,获取最新 AI 资讯

免费获取 AI 落地指南

3 步完成企业诊断,获取专属转型建议

已有 200+ 企业完成诊断