大数跨境

GPT Images 2.5 突发上线!网友的「灵魂画作」一个比一个离谱

GPT Images 2.5 突发上线!网友的「灵魂画作」一个比一个离谱 APPSO
2026-09-09
2
导读:重要的不是生成,而是修改

OpenAI 正式发布新一代图像生成模型 ChatGPT Images 2.5。官方表示,新模型在图片细节质量、生成速度、编辑精度及多轮修改一致性方面实现显著提升,并新增 Sketch 手绘参考、创作模板及图片评论编辑等功能,旨在让用户更贴近专业设计流程完成 AI 创作。

目前,用户每周通过 ChatGPT Images 及 API 中的 GPT Image 系列模型生成的图片数量已超过 30 亿张。Images 2.5 的推出,标志着 OpenAI 将进一步扩大 AI 图像工具在个人创作、营销设计及产品视觉等场景的应用范围。

核心升级:精准编辑与上下文一致性

相比上一代 Images 2.0,Images 2.5 最大的突破在于对“修改”指令的理解能力。过往 AI 绘图擅长从零生成,但在调整细节时容易误改其他部分(如修改服装导致脸部特征变化)。Images 2.5 优化了精准编辑能力,能准确执行指定修改,同时保留原有主体、构图和视觉风格,实现对产品、背景、文字等单个元素的独立调整。

人物特征保持与风格转换

实测显示,Images 2.5 在保持参考人物面部特征方面表现优异。模型能在改变摄影风格、服装和环境的同时,确保人物身份的高度一致性。例如,可将普通头像转换为复古写真,或将宠物照片融入新视觉主题,关键特征均得以保留。

在影视角色合成场景中,模型能稳定保留参考照片人物的脸部结构、表情和姿态。测试案例中,“马斯克与教父在片场自拍”及街头摄影风格的生成结果,均有效避免了以往常见的人物脸部变形或比例错误问题。

复杂逻辑与艺术风格理解

Images 2.5 对产品视觉设计及复杂视觉逻辑的理解显著增强。在“全毛绒材质可乐罐”的测试中,模型准确呈现了材质质感;在递归画面测试中(猫拿着显示同一画面的 iPad),模型成功识别并完成了多层视觉嵌套效果。

在艺术风格方面,模型不仅能生成接近游戏概念原画的黑神话风格画面,还能精准还原《三国演义》连环画的黑白线描、淡彩上色及老式纸张质感,而非简单堆叠古装元素。

此外,Images 2.5 在中文文本生成方面依旧表现亮眼。

待优化问题

尽管能力提升明显,Images 2.5 仍存在部分缺陷。实测发现,生成图像的噪点控制仍有待改进,且官方展示案例中偶见细节瑕疵。

新功能:Sketch 手绘与创作模板

为优化创作流程,OpenAI 为 ChatGPT 引入了一系列新功能。

Sketch 手绘参考

Sketch 功能允许用户直接在 ChatGPT 中绘制草图作为视觉参考。用户只需简单勾勒房间布局、服装轮廓或创意草稿,AI 即可结合描述生成完整图片。该功能有效解决了用户难以用文字准确描述空间关系的痛点,同时也支持 GIF 等动态内容创作。

模板与协作功能

新增的模板功能覆盖海报、商品图片等常见设计场景,用户可基于模板补充文字和风格要求,无需从零开始。此外,用户现可直接在图片上添加评论以指定修改位置,并分享提示词供他人基于同一创意进行二次创作。

API 模型升级与开放情况

面向开发者,OpenAI 同步推出两款 API 图像模型:

  • GPT Image 2.5 Flare:默认模型,兼顾质量、编辑能力与速度。相比前代,延迟降低 50%,适用于社交内容、电商视觉及大规模图片生成。
  • GPT Image 2.5 Sunburst:面向高要求创意工作流,强调精细控制能力,适用于广告素材制作及高端产品设计。

目前,ChatGPT Images 2.5 已向 ChatGPT、ChatGPT Work 和 Codex 用户开放,覆盖桌面端、移动端和网页端;API 用户可调用上述两款新模型。

ChatGPT Images 2.5 的发布不仅是模型的迭代,更意味着 AI 在理解视觉内容、保持上下文一致性及根据反馈持续调整方面迈出了重要一步,将成为 AI 理解世界的重要组成部分。

*部分图片由 AI 生成

【声明】内容源于网络
0
0
APPSO
AI第一新媒体,「超级个体」的灵感指南。 #AIGC #智能设备 #独特应用 #Generative Al
内容 15731
粉丝 0
APPSO AI第一新媒体,「超级个体」的灵感指南。 #AIGC #智能设备 #独特应用 #Generative Al
总阅读422.4k
粉丝0
内容15.7k