9 月 8 日,OpenAI 正式发布 ChatGPT Images 2.5。相比上一代,新版本重点解决了生成等待时间长、局部修改易破坏整体画面、以及连续编辑导致人物走样三大痛点。此次更新不仅升级了底层模型,更引入草图生成、图片评论、常用模板及提示词分享等功能,旨在将图片生成从“一次性出图”转型为可反复迭代的创作工具。
局部编辑更精准,多轮一致性提升
针对以往 AI 改图常出现的“牵一发而动全身”问题(如仅想换装却改变了人物长相或背景),Images 2.5 优化了对修改区域的判断逻辑。在调整服装、背景、商品或文字时,模型能更好地保留原有主体、构图及视觉风格。
新模型特别加强了对人物和宠物特征的保持能力。无论是将生活照转为证件照、复古风还是广告海报,生成结果均能高度还原原人物的面部特征。官方示例展示了同一人物在服装修改前后的效果,主体一致性显著增强。
此外,新模型在多轮编辑中的一致性有所突破。用户在连续修改图片时,已确认的内容在后续操作中不易发生变动。媒体 Axios 体验后认为,新版在保留人物相似度及处理细节修改方面确有实质改善。
新增 Sketch 草图功能
为解决文字描述构图的难点,新版本新增了 Sketch 功能。用户可在 ChatGPT 中绘制简单草图,并补充风格、颜色和场景要求,模型会将草图作为布局参考生成完整图片。该功能适用于规划房间家具布局、设计服装轮廓或安排海报标题与商品摆放等场景。

交互功能全面升级
除了核心模型能力的提升,新版本还引入了多项辅助操作功能:
-
提供海报、商品图等模板,支持快速启动创作; -
支持直接在图片上添加评论,精准指出需修改的位置; -
分享图片时可同步分享提示词(Prompt); -
支持针对单一元素进行修改,最大程度保留其余画面内容。
生成速度最高提升 50%
OpenAI 表示,Images 2.5 的图片生成延迟相比 2.0 版本最多降低约 50%。实际提速效果受图片尺寸、任务复杂度、服务器负载及所选模式影响,并非所有场景都能达到翻倍速度。
目前,ChatGPT Images 2.5 正向 ChatGPT、ChatGPT Work 和 Codex 用户推送,覆盖网页端、桌面端和移动端。所有套餐均可使用,但不同账号看到新功能的时间可能存在差异。
开发者 API 模型细分
面向开发者侧,OpenAI 推出了两款专用 API 模型:
定价依据模型、图片规格及使用方式计算。Flare 适合追求效率的场景,Sunburst 则面向对细节和一致性要求更高的任务。
真实感提升伴随安全风险
随着生成图片逼真度的提高,滥用风险也随之增加。OpenAI 在系统卡中承认,高真实感可能被用于制作更具欺骗性的深度伪造内容,涉及公众人物、政治事件及敏感场景。
为此,Images 2.5 建立了三重检查机制:对提示词、输入图片和最终生成结果进行严格审核。生成的图片将继续附带 C2PA 来源信息,并嵌入不可见水印,以协助外部系统识别 AI 生成内容。
然而,技术标记无法彻底根除伪造问题。图片经截图、压缩或二次编辑后,部分来源信息可能丢失。因此,平台审核、媒体核验及用户自身的判断依然不可或缺。
从“生成”走向“协作”
ChatGPT Images 2.5 的发布标志着产品重心的转移:从单纯追求“生成一张好看的图”,转向“陪伴用户逐步完善一张图”。通过草图、模板、评论反馈及多轮局部编辑,AI 图片工具正演变为“图片协作”平台。
对普通用户而言,这意味着无需一次性编写完美的提示词;对设计、广告及电商团队来说,更稳定的主体保持和局部修改能力将大幅减少返工时间。
尽管官方样例表现出色,但 Images 2.5 在文字准确性、复杂构图能力及真实业务场景中的成本表现,仍需更多独立测试验证。可以确定的是,AI 图片工具的竞争焦点正在发生变化:画面的第一眼吸引力固然重要,但能否按要求反复修改并稳定交付,正成为更关键的衡量标准。
OpenAI 官方发布说明及产品更新日志
OpenAI ChatGPT Images 2.5 系统卡
Axios 早期体验报告

