大家好,我是萝卜哥~
今天 OpenAI 发布 ChatGPT Images 2.5,我本来想用半小时测完赶紧写篇文章交差。结果一不小心从上午八点玩到了晚上七点,做了上百张图,真的是玩嗨了啊。
说真的,这次更新最让我上头的地方,是它新加的那堆编辑工具。
Sketch 让你随手涂鸦就能出大片,Comment 让你在图上指哪改哪,Erase 能擦掉任何东西让 AI 脑补,Templates 一键就能出周边贴纸。
每个功能单独看都还行,但组合起来玩的时候,那种卧槽还能这样的感觉一直在冒出来。
下面是我玩出来的首批有意思的用法,每种都附了完整的 prompt,你们直接拿去玩。
这个功能我强烈建议每个人都去试一下,因为它带来的那种反差感真的太解压了。
我先画了一个极其潦草的火柴人,站在一个歪歪扭扭的方块上,旁边画了一个太阳,就是一个圈加几条线那种幼儿园水平的太阳,然后配了这段 prompt。
出来的效果我直接笑出声了。
那个歪歪扭扭的火柴人变成了一个史诗感拉满的战士,站在悬崖上,披风飘着,远处有城堡。最关键的是,人物站的位置、太阳的位置、所有的空间关系都跟我那个丑涂鸦一模一样。
然后我想测测它的下限在哪里,画了一个更离谱的。就画了三个圆圈,从左到右由小到大排列,下面一条横线当地面。
三个圆圈变成了三个石头传送门,大小关系和我画的完全一致,雾气和萤火虫的效果加得恰到好处。
说实话我画的那个涂鸦拿给你看,你根本猜不到最后能出来这种效果。
同一个涂鸦,连换三种完全不同的 prompt 方向,看同一组圆圈加横线能变出什么花样。
三张图构图完全一致,因为 Sketch 锁住了空间逻辑。但出来的视觉效果天差地别。
这就是 Sketch 最好玩的地方:你的涂鸦就像一个模具,往里灌什么材料全靠你的想象力。
Comment 是这次更新里我觉得最 magic 的功能。
你在图片上任意位置点一下,写一句话描述你想改什么,模型就只改那个位置,其他地方一个像素都不动。
听起来简单对吧?但当你真正上手的时候,那种「指哪打哪」的掌控感会让你停不下来。
我先生成了一张基础场景图。
然后我开始一个位置一个位置地改,纯粹为了好玩。
第一下,点在拿铁杯上
拿铁上的心形拉花变成了一只猫脸,连胡须都有,杯子本身一点没变。
第二下,点在窗外的模糊街景
窗外变成了下雪天,窗户上出现了水雾和雪花颗粒,但室内的暖色调完全没被影响。
第三下,点在牛角包上
牛角包变成了一块日式芝士蛋糕,旁边多了一把小叉子,盘子还是原来那个。
第四下,点在 MacBook 上
笔记本打开了,屏幕上有代码,桌面上甚至出现了屏幕的微弱反光。
有个惊喜的发现,它写的 Python 代码好像是真正可运行的啊,这不就是 flask 代码吗,太牛了吧。
四次 Comment,同一张图完全变了味道,但整体的光影、视角、氛围还是那个咖啡馆,没有任何割裂感。
接下来是真正好玩的部分。
我发现 Comment 可以用来玩「画面剧情推进」,就是在同一张图里,通过不断点不同的位置改细节,让画面讲一个故事。
第五下,点在窗户上
窗外出现了一只手按在玻璃上,有点悬疑的氛围了。
第六下,点在桌面空的地方
桌上多了一张写着字的纸条,「LOOK BEHIND YOU」渲染得清清楚楚。
第七下,点在芝士蛋糕上
蛋糕被咬了一口,盘子上有碎屑。
你看,同一张温馨的咖啡馆照片,通过 Comment 一步步变成了一个悬疑短片的定格画面。每一步改动都非常细微,但叠加起来整个画面的「故事感」完全不一样了。
Comment 做产品图也特别快。
就比如下面这一组图片,就可以一点点通过 Comment 做出来。
这个玩法是我当天花时间最多的,因为一旦开始就收不住。
起点是一个简单的想法:我每天做 AI 早报,想搞一个固定的萝卜小人 IP 形象。
然后前段时间刚自己设计了一个,那就继续用这个 IP 形象来做实验。
我拿着这张参考图开始了漫长的「IP 开发之旅」。
第一行:「哈哈哈」(笑到流泪,嘴巴大张),「啥?!」(震惊,双手捂脸颊),「OK」(竖大拇指,自信地眨眼)
第二行:「不行」(双臂交叉,生气皱眉,挑起一边眉毛),「爱你」(双手在头顶比心,脸颊红红的),「跑!」(奔跑姿势,一只脚离地,惊慌的表情)
第三行:「睡觉」(躺下,头上飘着 zzz,安详的表情),「有了!」(一只手举起食指,头顶亮起灯泡),「哭了」(坐在地上,眼泪哗哗流,夸张的悲伤)
角色必须保持这些特征:圆形黑框眼镜、深蓝色连帽卫衣、头顶两片绿叶。保持同样的干净简约 3D 风格。每个表情要夸张到缩小当聊天贴纸时还能看清。
九个表情出来了,我觉得都非常到位,手里的萝卜宠物和人物形象都做成了表情包了,哈哈哈。
把这张九宫格截成单张,导入微信表情包,你的专属 IP 表情就有了。
拿着基础角色图当参考,换场景出早报配图。
角色一致性观察:角色一致性大概 80%。眼镜和卫衣每张都保持了,绿叶也在,但体型会有轻微浮动,整体在可接受范围内。
这是最让我兴奋的发现:选 Templates 里的 Merch 模板,上传萝卜人图片,就能直接出周边效果图。
比如我选择贴纸这个模版,然后输入:
出来的贴纸版萝卜人相当好看,六个 pose 各不相同,白色描边让它们看起来像真的可以撕下来的贴纸。
然后我又试了 T 恤
T 恤效果图也出来了,虽然角色印在衣服上之后色彩稍微有点饱和度偏高,但发到朋友圈说「萝卜哥要出周边了」绝对能骗到点赞,哈哈哈哈。
同一个萝卜人,换成完全不同的艺术风格。
三种风格出来之后,像素版保持了核心特征的辨识度,水墨版意外地有韵味,绿叶用淡绿色水彩点的,黏土版的微缩摄影感做得最好,手指印的细节都有。
一个 IP 形象,你可以用不同风格覆盖不同类型的内容。科技文章用原版 3D 风,国风内容用水墨版,游戏相关用像素版。一套 IP 三套视觉语言,全在一个下午搞定了。
这个测试我是当游戏来玩的,目标是看看 Image2.5 的多轮编辑到底能扛几轮不崩。
开局一张桌面俯拍。
然后一轮一轮改,每轮只动一样东西。
完美,抹茶的分层清清楚楚。
完美,文字拼写正确。
猫出现了,橘色,蜷着,很自然。
屏幕内容换了,仪表盘还挺好看的。
耳机消失了,桌面木纹修复得看不出痕迹。
这一轮模型做了一件很聪明的事。
它不光改了灯光颜色,还把桌面上所有物品的色温都调了,抹茶杯表面多了一层冷调反光。它能理解光源变化意味着什么,这点让我印象很深。
相框加上了,但仙人掌的盆从陶土色偏向了棕红色。第一个漂移信号出现了。
猫睁了一只眼,有点滑稽。
这 8 轮测试下来,无可挑剔。每一轮改动都精准命中目标,其他物品的位置、大小、光影全都稳如老狗。
这个玩法是我觉得最有实际价值的。
你手机里肯定有一堆随手拍的照片,光线不好、背景乱、角度歪,扔在相册里永远不会翻到。现在可以把它们变成完全不同级别的图片。
我拿了一张水杯的照片,手机随手拍的,有各种杂物做背景,光线昏暗,看着就很随意。
出来的白底图真的像棚拍的。光线均匀,投影恰到好处。
但有趣的部分在后面。同一个杯子,我让它去旅行。
电商朋友重点看:同一个杯子,四种完全不同的氛围,杯子的外观在每张图里都保持一致。做电商的朋友,这等于你一个下午就能把一整年的主图素材准备好:春夏秋冬四个版本。
白底图做好之后,淘宝要 1:1,小红书要 3:4,拼多多横幅要 16:9。以前每个平台都要重新调构图。
现在用 Resize 直接改比例就行了。
1:1 转 3:4 的时候杯子自动上移,底部留出更多空间。转 16:9 的时候杯子缩小居中,两侧出现留白。一张图三个尺寸,一分钟搞定。
Templates 是 2.5 里最容易被忽略的功能,因为它藏在工具栏里面不太起眼。
但这玩意用起来真的爽。
比如我最喜欢的这个 Poster 模板做活动海报。
我用我的御用数字人模特来做一个素人出道的海报,是不是还挺有感觉的。
然后还可以不断地切换风格。
然后想不出什么其他的风格了,直接让 GPT 自己去想就行。
依托 GPT 世界知识能力,我们一句话就能让 Image 2.5 来生成连环画。
比如红楼梦的:
还有西游记的:
它对这些名著的情节拿捏的还是非常准确的,几乎都是我们耳熟能详的片段。
跑完这一整天的测试,让我印象最深的有三件事。
第一:Sketch 的反差感
你画得越丑、构图越随意,最后出来的大片效果跟原稿之间的落差越大,那种「不可能吧」的感觉特别上头。它真正解放的是那些有想法但画不出来的人。
第二:Comment 的精准度
在一张复杂的图上,你点一个咖啡杯它就只改咖啡杯,旁边的笔记本、植物、光影全部不动。这种「指哪打哪」的交互方式让图片编辑从技术活变成了创意活,你只需要想「这里换成什么好」,执行的部分交给 AI。
第三:工具串起来之后的化学反应
Sketch 出构图,Comment 精修细节,Erase 做创意替换,Resize 出多尺寸,Templates 出物料,Version History 随时存档读档,Prompt Sharing 把你的创意变成可分享的链接。每个功能单独用都只是「还行」,但它们串成一个链条之后,出图的速度和质量都到了一个让我觉得「够用了」的程度。
工具玩法摆在这了,剩下的就是你的想象力。
去玩吧。
以上就是今天的分享,觉得有帮助,帮请帮一键三连:点赞、转发,再看和留言,你的反馈对我很重要!

