OpenAI 推出新一代办公模型 GPT-6 Astra,具备强大的计算机操作与复杂任务处理能力,无需 API 即可操作日常办公软件。该模型在成本效益与安全对齐上大幅升级,已向企业及 API 用户开放。
OpenAI 正式推出新一代旗舰模型 GPT-6 Astra,目前已上线 ChatGPT Work、Codex 以及开发者 API。作为主打高阶办公场景的模型,Astra 在计算机操作(Computer Use)、网页浏览、软件工程、网络安全及科学研究等基准测试中均达到顶尖水平,旨在帮助企业以更高的速度和准确度处理复杂工作。
大多数企业级 AI 方案需要前期繁琐的数据清洗、流程改造与定制化 API 对接。Astra 打破了这一限制。在 ChatGPT Work 和 Codex 中,它能够像人类一样直接操作各类桌面应用与界面,即使软件本身没有开放 API 也能正常运行。
这意味着企业无需漫长的前期工程准备,首日即可将 AI 融入现有工作流。在2023 年微软 Excel 世界锦标赛的金融建模挑战中,Astra 依靠模拟电脑操作完成任务的速度达到人类冠军的近四倍,大幅减轻了分析师在繁琐建模上的负担。
在 OpenAI 内部测试阶段,团队已深度使用 Astra:市场与开发团队借助它在短时间内将多机位素材剪辑成开发者体验视频;工程团队则利用它排查并解决了 Codex 的内存分配瓶颈,在仅增加约 30% 峰值内存的情况下,将交互延迟降低了 25 倍。此外,Astra 对企业品牌调性、PPT 模版及设计规范的遵循能力也显著提升。
Astra 专注于提升每单位成本的有效产出。通过强化训练,该模型能以更少的 Token 和重试次数完成复杂任务。在针对终端复杂任务的 Terminal-Bench 4.0 评估中,Astra 得分达 57.9%,显著高于 GPT-5.6 Sol(37.3%)与 Claude Fable 5.1(55.8%),同时单任务 API 预估成本分别降低约 9% 和 63%。
定价方面,GPT-6 Astra 的 API 价格为每百万输入 Token 10 美元,每百万输出 Token 50 美元。
让 AI 接入核心业务系统,安全可控是首要前提。Astra 在训练中大幅增强了对人类意图和授权的遵循度。在 OpenAI 内部针对敏感信息泄露、误删数据等严苛场景的计算机操作安全测试中,Astra 出现非预期行为的概率比 GPT-5.6 Sol 降低了 89%,比 Claude Fable 5.1 降低了 74.7%。
为防范风险,平台推出了多项企业级管控功能:
根据 OpenAI 的准备度框架,Astra 是首个达到关键网络安全能力门槛的模型。OpenAI 相应强化了防越狱与防滥用机制,并在符合条件的 API 节点上为企业提供零数据保留(Zero Data Retention)保护。
免费获取企业 AI 成熟度诊断报告,发现转型机会
关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断