OpenAI发布ChatGPT Images 2.5:生成延迟最多降50%,支持在图片上批注修改
新模型最高仍为3840px,新增xhigh和max质量档位;OpenAI同时推出GPT-Image-2.5 Flare与Sunburst两个API模型,文本输入5美元/百万tokens、图像输出30美元/百万tokens。
AI解读:这条新闻的核心不是“画得更好看”,而是把生图模型往可反复修改的生产工具方向推了一步。Images 2.5支持在图片上直接圈注要改的地方,多轮编辑时更强调保住上一轮已经改好的部分,针对的正是设计、电商这类“一张图要改很多轮”的场景。
对每天要出几十上百张图的人来说,最实际的数字是生成延迟相比2.0最多降低50%。既然官方鼓励你先改内容、再改版式、最后抠细节,等待时间减半的意义可能比画质提升更直接。
需要留意边界:最高分辨率仍是3840px,官方Demo中也出现了换装后影子轮廓没同步、手绘草图比例出问题、部分区域仍有AI涂抹感等情况。量子位提到已有网友反馈细节变好但人物肢体偶尔更易翻车,这些属于实测观察,不是官方结论。
开发者方面,OpenAI同时发布Flare和Sunburst两个API模型,前者定位质量、编辑与速度的平衡,适合社交内容、快速视觉原型和大批量生图;后者面向广告素材、产品图片等更精细需求。两者token计费相同:文本输入5美元/百万tokens,图像输入8美元/百万tokens,图像输出30美元/百万tokens。
OpenAI发布新一代生图模型ChatGPT Images 2.5。据量子位2026年9月10日报道,该模型主打生成更快、细节更好,改图更接近“真·修图”。
OpenAI给出的四个升级重点为:相比Images 2.0,生成延迟最多降低50%;参考照片里的人和物更容易保住原本特征;连续修改多轮时前面改好的细节更容易保持一致;支持直接在图片上添加批注,告诉AI具体要改哪里。
草图可作为视觉参考,进度支持百分比显示
Images 2.5新增直接拿草图当参考图的用法:在对话框中@Sketch自行绘制草图,再补充想要的风格和细节,GPT会将其作为视觉参考生成完整图片。报道称该功能适合“脑子里大概知道想要什么构图、但找不到合适参考图”的情况。
OpenAI同时提供了一套新的模板。ChatGPT现在支持显示百分比生成进度。
质量档位增加,分辨率上限不变
相比4个半月前发布的GPT Image 2,Images 2.5的重点在生成质量和编辑稳定性。它没有继续提高输出分辨率,最高依然是3840px,但新增了xhigh和max质量档位,用于提升细节、材质纹理、光照以及参考主体的保真度。
量子位在官方Demo中看到,给小孩换衣服后脸部基本没怎么漂,原图中卷发的毛躁质感保留较完整;但给小狗换装的示例中,主体改对了,影子后背轮廓似乎仍保留原来的形状。报道认为,穿上衣服后影子后背也应变平滑。
另一组把原始照片重新还原、放大并重新处理打光的示例,报道称效果“挺惊艳”。
批注修改与多轮一致性
ChatGPT支持直接在图片上批注修改,思路类似给设计稿提意见:不用写一长段描述,直接圈出位置并写一句要求。报道举例,在表情包生成界面中于墨镜位置批注“换成黑框眼镜”并发送,GPT能识别指的是哪一个。一张图里人物、物体较多时,该功能更适用。
官方还展示了旅行票券的局部编辑演示,对应实际工作中“版式已定、只替换城市信息、每版沿用前面设计”的物料制作场景。
多轮编辑一致性是另一个重点。报道描述了设计工作的常见流程:第一轮生成主体,第二轮改排版,第三轮换文字,第四轮抠细节;以前容易出现“这次这里终于对了,刚才已经对的地方又坏了”。OpenAI表示,在更长的对话中,Images 2.5可以更稳定地接着上一轮结果继续修改,同时保住已确认的内容和画质。报道以旅行攻略海报为例,称文字、照片、路线、排版挤在一张图里时,可以先换目的地,再继续改单独的文字和细节。
复杂画面理解升级,实测反馈不一
除编辑外,Images 2.5对复杂画面、材质和风格指令的理解也一并升级,官方展示了碎玻璃、日杂封面和《银翼杀手》式科幻画面的Demo。
量子位自行测试时,用一张猴子照片生成“猴子在世界各地旅游打卡”照片,GPT输出4张。报道称部分区域仍能感觉到AI“涂抹感”;有网友测试手绘草图,大方向能跟上,但一些比例关系会出问题;材质和体积感提升明显,例如皮革、鞋底、褶皱和立体感更扎实。也有网友反馈,细节好了不少,但人物肢体偶尔更容易翻车。报道原文据此提出“是史诗级升级,还是这边补好那边又冒新Bug”的疑问。
报道还提到,有网友用该模型做定格动画,有人感叹细节已很离谱。
两个API模型与价格
面向开发者,OpenAI同时发布两个API模型。GPT-Image-2.5 Flare更强调质量、编辑能力和速度之间的平衡,是官方推荐大多数应用默认使用的版本,适合社交内容、快速视觉原型和大批量生图等场景。
GPT-Image-2.5 Sunburst瞄准更精细的创作和编辑需求,比如正式投放的广告素材、产品图片,以及对画质要求更高的视觉内容。
两者目前采用相同token计费:文本输入5美元/百万tokens,图像输入8美元/百万tokens,图像输出30美元/百万tokens。
报道认为,Images 2.5没有像2那样带来直接生成老照片质感的视觉冲击,但把生图模型进入生产流程后多轮交互、定点修改的问题进一步清扫,过去用生图模型多少有点“抽卡”,现在可以直接定点修改。
以上内容依据量子位报道及其引用的OpenAI技术博客与官方Demo整理,未独立验证。