OpenAI预览Ultrafast服务层,借助Cerebras硬件让GPT-5.6 Sol生成速度达到每秒750个token,较标准处理快14倍。该功能率先在API中提供,让前沿模型在毫秒级场景中发挥作用,覆盖事件响应、金融研究、客户支持等实时工作流。
OpenAI今天公布了Ultrafast服务层的早期预览版,该服务层可让GPT-5.6 Sol以比标准处理快14倍的速度运行,首先在OpenAI API中推出。得益于Cerebras的支持,Ultrafast每秒可生成高达750个输出token,将OpenAI最智能的模型带到分秒必争的产品和工作流程中。
随着GPT-5.6的发布,OpenAI正推动模型能力边界,并在整个技术栈中提高效率。这些改进让高级智能更实惠、对更多用户更有用。此前,实时响应速度通常意味着选择更小或更专精的模型。Ultrafast指向了一个新方向:每秒完成更多有价值的工作。
当速度不再以牺牲智能为代价时,AI就可以进入业务中最具时效性的环节,催生新的工作类型。OpenAI已经观察到一些活跃的应用场景:
预览期间,OpenAI与首批客户合作,探索速度在哪里能产生最大差异,以及这些经验如何指导产品演进。如果企业需要以最高速度使用前沿智能,可注册等待通知,获取扩展访问权限。
早期客户体验如何?
OpenAI已在一批涉及编程、电商、金融研究、支持等交互式应用的公司中测试Ultrafast模式下的GPT-5.6 Sol。从业务流程入手,可以在真实生产环境中研究这些条件。早期工作帮助OpenAI理解数量级速度提升创造最大价值的环节,以及当模型能跟上用户节奏时产品会发生怎样的变化。OpenAI将利用这些发现指导容量扩展后的部署。
OpenAI内部如何使用?
在OpenAI内部,一组开发人员正在测试Ultrafast模式下的GPT-5.6 Sol,以了解哪些工作流能从实时响应的前沿智能中受益。
事件响应是一个例子。当警报触发时,工程师需要在系统和证据仍在变化时快速建立准确图景。团队用Ultrafast快速读取日志、分析追踪、综合对话、识别下一步检查项,并帮助准备或验证修复方案——所有这一切都在极短时间内完成,同时保留Sol的智能水平。它缩短了从观察信号、验证假设到选择下一步行动之间的延迟,而工程师仍负责最终判断和部署。
在研究方面,团队用Ultrafast快速检索知识来源、查询数据,并跨互联工具收集、组织和汇总信息。以往常见的工作流程是夜间启动一批实验,早上查看结果。有了Ultrafast,这一循环被压缩到工作日内即可完成多次迭代。
Cerebras技术支持
Ultrafast标志着OpenAI与Cerebras合作的最新进展,旨在为OpenAI平台带来超低延迟推理。现在,Ultrafast模式下的GPT-5.6 Sol由Cerebras支持,每秒最多输出750个token,使企业能够构建更敏感的响应产品、更快决策,并将强大的AI直接融入要求最高的工作流。
可用性
Ultrafast模式下的GPT-5.6 Sol今天面向少数客户提供有限预览。随着容量增长,访问将逐步开放。可注册获取更新。
免费获取企业 AI 成熟度诊断报告,发现转型机会
关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断