OpenAI 宣布 Ultrafast 服务层级,由 Cerebras 提供支持,让 GPT-5.6 Sol 的生成速度最高达到标准模式的 14 倍,每秒输出 750 token。预览版面向精选客户开放,标志着前沿智能首次能兼顾极致速度与高智能,适用于事件响应、实时金融分析等场景。
OpenAI 今日预览 Ultrafast,一种新的服务层级,可使 GPT-5.6 Sol 的运行速度比标准处理最高快 14 倍,并率先在 OpenAI API 中推出。Ultrafast 由 Cerebras 提供支持,每秒最多生成 750 个输出 token,让最智能的模型能够用于分秒必争的产品和工作流。
OpenAI 在推出 GPT-5.6 的同时,正通过技术栈各层面的优化提高模型效率,让先进智能变得更实惠,并惠及更多人。此前,实时响应通常意味着只能选择更小或更专业的模型。Ultrafast 展示了新的方向:每秒完成更多有价值的工作。
预览期间,OpenAI 正与首批客户合作,在事件响应、金融研究、客户支持、商业及实时研究等场景测试其潜力。当速度不再牺牲智能,AI 就能深入企业最苛刻的环节,催生全新工作方式。早期实践表明,数量级的速度提升能显著缩短从观察到验证、决策的周期。
OpenAI 内部团队也已开始用 Ultrafast 处理事件响应和研究工作流,例如快速读取日志、分析跟踪数据,并在一个工作日内完成多轮实验迭代,而此前往往需要过夜运行。
Ultrafast 标志着 OpenAI 与 Cerebras 的合作进入下一阶段,双方旨在为 OpenAI 平台带来超低延迟推理。目前 Ultrafast 模式下的 GPT-5.6 Sol 已面向部分精选客户开放限量预览,OpenAI 将随容量增长逐步开放更多名额。注册可获取最新动态。
免费获取企业 AI 成熟度诊断报告,发现转型机会
关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断