前途科技前途科技
  • 服务
  • 关于
  • AI
    • AI 大模型
    • 具身智能
    • 算力芯片
  • 科技
    • 智能终端
    • 软件·互联网
    • 汽车·出行
    • 科学前沿
  • 资源中心
    • 深度研究
      • AI 前沿
      • 教程
      • AI 知识库
      • 案例研究
    • 行业报告
      • 白皮书
      • 行业报告
      • 研究报告
      • 技术分享
      • 专题报告
    • 精选案例
      • 金融行业
      • 医疗行业
      • 教育行业
      • 零售行业
      • 制造行业
  • 服务
  • 关于
联系我们
产品/09.10 · 00:00/4 MIN/编译自 henry/0 阅读

OpenAI发布ChatGPT Images 2.5:延迟降低50%且支持图片批注修图

OpenAI推出新一代图像生成模型ChatGPT Images 2.5,生成延迟最高降低50%。新模型大幅提升了多轮编辑的一致性与细节质感,支持草图引导生成与图片直接圈选批注修图,并同步开放两款开发者API。

OpenAI 正式发布新一代图像生成模型 ChatGPT Images 2.5。新版本核心聚焦于生成速度的飞跃、画面细节的提升,以及真正可用、可控的图像编辑体验。

ChatGPT Images 2.5 官方展示

根据 OpenAI 官方介绍,Images 2.5 的核心升级主要涵盖以下四个维度:

  • 生成速度大幅提升:相比上一代 Images 2.0,端到端生成延迟最高降低 50%;
  • 主体保真度更高:参考照片中的人物面貌与物体特征在重绘时能够稳定保留;
  • 多轮编辑稳定性强化:连续多次局部调整后,前期确认的细节与整体风格不再轻易漂移;
  • 支持原图批注交互:用户可直接在生成图上圈选画框并添加文字批注,精准传达修改指令。

草图交互与精准批注:像专业设计师一样修改细节

在交互体验上,ChatGPT Images 2.5 引入了直接支持草图作为视觉参考的新功能。当用户具备清晰的构图意图却缺少现成参考图时,只需在对话框中调用 @Sketch,即可通过画笔手绘出基本的空间布局和线条框架。

手绘草图作为参考输入

系统会将草图作为构图基准,结合提示词补充的材质和光影风格,输出完整的最终画面。

根据草图生成的最终图像

针对常用设计需求,平台还提供了预设模版,进一步降低提示词构建门槛。

预设设计模版

此外,生成界面还新增了百分比进度条显示,直观展示图像渲染进度。

生成进度百分比显示

强化局部编辑能力与多轮一致性

在模型底层能力方面,Images 2.5 没有盲目推高分辨率上限,最大输出依然保持在 3840px,但新增了 xhigh 与 max 质量档位,重点改善细节质感、材质纹理、光照连贯性以及参考主体的保真度。

人物换装细节保真演示

在官方展示的人像换装示例中,人物面部轮廓及卷发发丝的微小毛躁感均得到精准保留,未出现明显的脸部走形。

动物换装测试与阴影表现

在旧照片修复与放大重绘场景下,模型对光照与面部细节的重构同样表现出极高的真实感。

老照片还原与重新打光演示

针对电商应用场景,用户常需为模特连续更换服装或背景。以往模型极易在换装过程中改变人体比例或场景透视,而 Images 2.5 在保持人物与环境比例协调方面取得了显著提升。

更具突破性的是图上直接批注修图功能。用户无需再输入冗长复杂的空间方位描述,只需在目标元素位置圈选并注明修改意见(例如直接在墨镜处标记“更换为黑框眼镜”),模型即可准确定位并完成局部替换。

图上直接批注修改墨镜样式

多轮票券设计调整演示

以往基于扩散模型的编辑交互中,最令创作者困扰的是“改了新局部、坏了旧版面”。Images 2.5 重点强化了多轮修改的上下文一致性。即使面对版式复杂的海报或信息物料,用户在调整目的地、替换文案和微调局部插图的整个长流程中,既定排版和主体风格都能维持稳定。

旅行攻略海报多轮排版与文案修改

复杂画面与材质表现力升级

在生成基础画质上,模型对复杂材质、破碎物理效果及特定美术风格的还原度也同步升级。

碎玻璃质感生成效果

杂志封面排版风格生成效果

科幻赛博朋克风格场景生成

社区测试展现了其在复杂场景下保持参考主体特征的能力:

标签:OpenAIChatGPTAPI

想了解 AI 如何助力您的企业?

免费获取企业 AI 成熟度诊断报告,发现转型机会

置顶文章

拒绝率清零,代价是拒掉 74% 的正常问题:安全对齐评测漏掉的另一半
置顶

拒绝率清零,代价是拒掉 74% 的正常问题:安全对齐评测漏掉的另一半

拆解 Claude 文本水印:不是绿名单,是锦标赛采样,以及它在中国合规里挡得住的那一半
置顶

拆解 Claude 文本水印:不是绿名单,是锦标赛采样,以及它在中国合规里挡得住的那一半

前途科技前途科技
服务关于快讯技术商业报告
前途科技微信公众号

微信公众号

扫码关注

Copyright © 2026 AccessPath.com, 前途国际科技咨询(北京)有限公司,版权所有。|京ICP备17045010号-1|京公网安备 11010502033860号|隐私政策|服务条款

参考主体在不同场景下的打卡合成

用户利用连续生成制作的定格动画片段

在皮革、鞋底纹理和衣物褶皱等细分材质上,画面的体块感与体积真实度均有长足进步。

鞋履材质与皮革细节真实感演示

不过社区实测也反映出,手绘草图在处理极端透视比例时偶有失衡,个别人体复杂姿态在极端修图下仍有翻车概率。

手绘草图生成透视表现测试

双版本 API 同步上线与计费标准

针对企业级开发与集成需求,OpenAI 同步推出了两款全新 API 模型:

  1. GPT-Image-2.5 Flare:主打画质、编辑能力与生成速度的综合平衡,作为官方推荐的通用版本,适用于社交物料生成、视觉原型探索及批量自动化管线。

GPT-Image-2.5 Flare 生成效果

  1. GPT-Image-2.5 Sunburst:面向高精度商业视觉需求打造,专门适配正式广告投放素材、高端商品渲染及对光影严苛要求的视觉生产环境。

GPT-Image-2.5 Sunburst 精细化生成效果

计费方面,Flare 与 Sunburst 均采用统一定价方案:

  • 文本输入:5 美元 / 百万 Token
  • 图像输入:8 美元 / 百万 Token
  • 图像输出:30 美元 / 百万 Token

ChatGPT Images 2.5 API 价格明细

从无序抽卡到可控修图,ChatGPT Images 2.5 的演进表明,AI 生图正在从单纯追求视觉奇观,真正迈入追求确定性与生产级协同的新阶段。

NeoMME 拆解:单塔多模态编码器如何把视觉 RAG 索引压到每页 6 KB
置顶

NeoMME 拆解:单塔多模态编码器如何把视觉 RAG 索引压到每页 6 KB

//

24小时热榜

RLHF先驱Paul Christiano加入OpenAI基金会董事会
TOP1

RLHF先驱Paul Christiano加入OpenAI基金会董事会

小米破局:短期看汽车,中期看手机,长期看AI
TOP2

小米破局:短期看汽车,中期看手机,长期看AI

3

超越序列预测:AI何时能复原现实世界的隐藏规律?

10小时前
超越序列预测:AI何时能复原现实世界的隐藏规律?
4

OpenAI 发布 GPT-6 Astra:主打电脑操作与办公自动化

11小时前
OpenAI 发布 GPT-6 Astra:主打电脑操作与办公自动化
5

蓝色光标合作AhaCreator,用AI重构全球达人营销

18小时前
蓝色光标合作AhaCreator,用AI重构全球达人营销
6

理想小米转向自研与二供,宁德时代面临多供博弈

18小时前
理想小米转向自研与二供,宁德时代面临多供博弈
7

Momenta逼近盈利,L3新规重塑智驾分工边界

18小时前
Momenta逼近盈利,L3新规重塑智驾分工边界
8

京东发布物理AI战略:建十万卡算力集群与世界模型

18小时前
京东发布物理AI战略:建十万卡算力集群与世界模型
热门标签
大模型AgentRAG微调私有化部署Prompt EngineeringChatGPTClaudeDeepSeek智能客服知识管理内容生成代码辅助数据分析金融零售制造医疗教育AI 战略数字化转型ROI 分析OpenAIAnthropicGoogle

关注公众号

前途科技微信公众号

扫码关注,获取最新 AI 资讯

免费获取 AI 落地指南

3 步完成企业诊断,获取专属转型建议

已有 200+ 企业完成诊断