前途科技前途科技
  • 洞察
  • 服务
  • 关于
  • AI 资讯
    • 快讯
    • 产品
    • 技术
    • 商业
    • 政策
    • 初创
  • 洞察
  • 资源中心
    • 深度研究
      • AI 前沿
      • 案例研究
      • AI 知识库
    • 行业报告
      • 白皮书
      • 行业报告
      • 研究报告
      • 技术分享
      • 专题报告
    • 精选案例
      • 金融行业
      • 医疗行业
      • 教育行业
      • 零售行业
      • 制造行业
  • 服务
  • 关于
联系我们

OpenAI 为 GPT-5.6 Sol 推出 Ultrafast 模式,最高提速 14 倍

产品2026年8月12日· 原作者:OpenAI Blog· 4 分钟阅读0 阅读

OpenAI 预览 GPT-5.6 Sol Ultrafast 模式:由 Cerebras 支持,输出最高每秒 750 token,较标准处理快 14 倍,并在 API 渠道先行开放。该模式让前沿模型进入应急响应、金融研究等对实时性要求极高的业务场景。

OpenAI 为 GPT-5.6 Sol 推出 Ultrafast 模式,最高提速 14 倍

OpenAI 今天提前披露了一个名为 Ultrafast 的新服务层级:GPT-5.6 Sol 在该模式下运行速度最高可达标准处理的 14 倍,首批通过 OpenAI API 开放。该服务由 Cerebras 提供底层支持,每秒最多可生成 750 个输出 token,让旗下最智能的模型能够进入那些每秒钟都至关重要的产品和工作流。

随着 GPT-5.6 的发布,OpenAI 一直在推进模型能力的前沿,并在技术栈的每一层 让模型更高效。这些改进使得高级智能 更便宜,也 对更多人更有用。此前,想要获得实时速度,通常意味着选择更小或更专用的模型;Ultrafast 则指向一个新的方向:每秒完成更多有价值的工作。

当速度不再以牺牲智能为代价,AI 就能进入企业中最讲究时效性的环节,全新的工作方式也随之成为可能。OpenAI 已经看到了几个令人振奋的适用场景:

  • 事件响应与可靠性:关键系统出现故障时,在故障仍在持续时分析应用日志、近期代码变更和工程师报告,定位可能的原因,并协助准备修复方案。
  • 金融研究与安全:在市场条件仍在变化时,分析行情信号、评估交易、识别可疑活动。
  • 客户支持与语音:即使要跨多个步骤或系统才能找到答案,也能在不打断对话的情况下实时解决复杂客户问题。
  • 电商:在购物者仍在决策时回答产品问题、查询库存、提供个性化推荐、解决结账问题,避免犹豫变成弃单。
  • 实时研究与实验:将原本需要整夜运行的研究变成互动式工作会话,让团队测试想法、查看结果、调整方法、再跑一轮实验,思路不被打断。

在预览阶段,OpenAI 正与一组初始客户合作,了解这种速度在哪些地方影响最大,以及这些经验如何反哺后续产品。如果你的业务需要最高速度下的前沿智能,可以 注册等待通知,以便在访问范围扩大时第一时间收到消息。

早期客户看到了什么

OpenAI 已通过 Ultrafast 模式测试 GPT-5.6 Sol,合作对象涵盖编码、电商、金融研究、客服等领域的公司。先从业务流程入手,是为了在真实生产环境中验证这些场景。早期工作帮助 OpenAI 理解:速度提升一个数量级在何处创造最大价值,以及当模型能跟上使用者节奏时,产品会发生哪些变化。这些发现将随容量增长指导后续部署。

OpenAI 内部如何使用 Ultrafast

在 OpenAI 内部,一组开发者也在测试 GPT-5.6 Sol 的 Ultrafast 模式,以弄清哪些工作流能从实时应答的前沿智能中受益。

事件响应是其中一个例子。当告警触发,工程师需要在系统和证据仍在变化时快速拼出准确全貌。团队用 Ultrafast 读取日志、分析追踪、综合对话内容、确定下一步检查项,并协助准备或验证修复方案——在极短时间内完成,同时保留 Sol 的智能。它缩短了从观察信号、验证假设到选择下一步行动之间的延迟,而最终判断和部署责任仍由工程师承担。

研究方面,团队用 Ultrafast 快速检索知识源、查询数据,并在多个关联工具间收集、整理和汇总信息。过去常见的做法是夜间跑一批实验、早上查看结果;有了 Ultrafast,这个循环被压缩到一个工作日内可以完成多轮迭代。

背后是 Cerebras

Ultrafast 是 OpenAI 与 Cerebras 合作的下一步,目标是把超低延迟推理带到 OpenAI 平台。现在,Cerebras 通过 Ultrafast 模式支持 OpenAI 最智能的模型,每秒最多输出 750 个 token,让企业能够构建响应更快的产品、做出更快的决策,并把强大的 AI 直接嵌入最苛刻的工作流。

可用性

GPT-5.6 Sol 的 Ultrafast 模式今天以有限预览形式面向部分选定客户开放,OpenAI 会随着容量增加逐步扩大访问范围。注册获取更新。


原文链接:OpenAI Blog
本文由前途科技编辑整理

标签:OpenAIGPT-5.6Cerebras推理速度API

想了解 AI 如何助力您的企业?

免费获取企业 AI 成熟度诊断报告,发现转型机会

置顶文章

会打字,就能"拍"电影:ScriptTask 开放限量内测
置顶

会打字,就能"拍"电影:ScriptTask 开放限量内测

//

24小时热榜

GPT-5.6 开发者指南:更低成本,更强智能体
TOP1

GPT-5.6 开发者指南:更低成本,更强智能体

OpenAI推Ultrafast模式:GPT-5.6 Sol提速14倍
前途科技前途科技
服务关于快讯技术商业报告
前途科技微信公众号

微信公众号

扫码关注

Copyright © 2026 AccessPath.com, 前途国际科技咨询(北京)有限公司,版权所有。|京ICP备17045010号-1|京公网安备 11010502033860号|隐私政策|服务条款
TOP2

OpenAI推Ultrafast模式:GPT-5.6 Sol提速14倍

3

OpenAI 任命 Dali Rajic 为首席营收官

2小时前
OpenAI 任命 Dali Rajic 为首席营收官
热门标签
大模型AgentRAG微调私有化部署Prompt EngineeringChatGPTClaudeDeepSeek智能客服知识管理内容生成代码辅助数据分析金融零售制造医疗教育AI 战略数字化转型ROI 分析OpenAIAnthropicGoogle

关注公众号

前途科技微信公众号

扫码关注,获取最新 AI 资讯

免费获取 AI 落地指南

3 步完成企业诊断,获取专属转型建议

已有 200+ 企业完成诊断