OpenAI推出新一代图像生成模型ChatGPT Images 2.5,生成延迟最高降低50%。新模型大幅提升了多轮编辑的一致性与细节质感,支持草图引导生成与图片直接圈选批注修图,并同步开放两款开发者API。
OpenAI 正式发布新一代图像生成模型 ChatGPT Images 2.5。新版本核心聚焦于生成速度的飞跃、画面细节的提升,以及真正可用、可控的图像编辑体验。

根据 OpenAI 官方介绍,Images 2.5 的核心升级主要涵盖以下四个维度:
在交互体验上,ChatGPT Images 2.5 引入了直接支持草图作为视觉参考的新功能。当用户具备清晰的构图意图却缺少现成参考图时,只需在对话框中调用 @Sketch,即可通过画笔手绘出基本的空间布局和线条框架。

系统会将草图作为构图基准,结合提示词补充的材质和光影风格,输出完整的最终画面。

针对常用设计需求,平台还提供了预设模版,进一步降低提示词构建门槛。

此外,生成界面还新增了百分比进度条显示,直观展示图像渲染进度。

在模型底层能力方面,Images 2.5 没有盲目推高分辨率上限,最大输出依然保持在 3840px,但新增了 xhigh 与 max 质量档位,重点改善细节质感、材质纹理、光照连贯性以及参考主体的保真度。

在官方展示的人像换装示例中,人物面部轮廓及卷发发丝的微小毛躁感均得到精准保留,未出现明显的脸部走形。

在旧照片修复与放大重绘场景下,模型对光照与面部细节的重构同样表现出极高的真实感。

针对电商应用场景,用户常需为模特连续更换服装或背景。以往模型极易在换装过程中改变人体比例或场景透视,而 Images 2.5 在保持人物与环境比例协调方面取得了显著提升。
更具突破性的是图上直接批注修图功能。用户无需再输入冗长复杂的空间方位描述,只需在目标元素位置圈选并注明修改意见(例如直接在墨镜处标记“更换为黑框眼镜”),模型即可准确定位并完成局部替换。


以往基于扩散模型的编辑交互中,最令创作者困扰的是“改了新局部、坏了旧版面”。Images 2.5 重点强化了多轮修改的上下文一致性。即使面对版式复杂的海报或信息物料,用户在调整目的地、替换文案和微调局部插图的整个长流程中,既定排版和主体风格都能维持稳定。

在生成基础画质上,模型对复杂材质、破碎物理效果及特定美术风格的还原度也同步升级。



社区测试展现了其在复杂场景下保持参考主体特征的能力:
免费获取企业 AI 成熟度诊断报告,发现转型机会


在皮革、鞋底纹理和衣物褶皱等细分材质上,画面的体块感与体积真实度均有长足进步。

不过社区实测也反映出,手绘草图在处理极端透视比例时偶有失衡,个别人体复杂姿态在极端修图下仍有翻车概率。

针对企业级开发与集成需求,OpenAI 同步推出了两款全新 API 模型:


计费方面,Flare 与 Sunburst 均采用统一定价方案:

从无序抽卡到可控修图,ChatGPT Images 2.5 的演进表明,AI 生图正在从单纯追求视觉奇观,真正迈入追求确定性与生产级协同的新阶段。
关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断