这是我的第494篇Ai笔记,本篇1909、累计笔记8480442
彩蛋:结尾扫描二维码,领取Buzzy神级手册。
这两天,AI生图圈冒出来一个很有意思的神秘模型。
在LMArena竞技场上,一个代号为 luna-lisa-alpha 的匿名模型开始被大量讨论。再加上有人收到了ChatGPT新的图片升级弹窗,社区直接给它安上了一个名字——GPT Image 2.5。
虽然OpenAI目前还没有正式公布“GPT Image 2.5”,官方公开版本仍然是今年4月发布的 ChatGPT Images 2.0。
但这批流出来的测试图,确实有点东西。
其中最离谱的一张,是一场根本没发生过的“GPT-6 Astra发布会”:舞台、主持人、YouTube直播界面、观众席、实时评论区全都有,第一眼看过去真的很像官方直播截图。
看到这里,我第一反应已经不是“画质又提升了多少”。
当AI开始连“证据长什么样”都能一起画出来,生图这件事正在进入一个新阶段。
以前评价AI生图,我们主要看三件事:人脸像不像、手指崩不崩、画面有没有AI味儿。
但真正难的,其实一直是信息密集型图片。
网页截图、社交媒体帖子、产品页面、手写文件、海报……这里面既有人物,又有大量文字、排版和界面结构。过去AI只要字一多,基本就开始发明新语言。
现在情况开始变了。
原稿里有人让模型伪造Sam Altman的社交平台发文,也有人要求它模仿爱因斯坦笔迹,在横格纸上写一篇完整的货币史文章,连咖啡渍都安排上了。
这意味着AI图片正在从“生成一张好看的图”,往生成一张看起来可信的信息载体继续走。
这个变化,我觉得比单纯提高一点清晰度重要得多。
这批公开测试里,我觉得最值得看的就三个能力。
01|文字终于开始能打了
原稿总结luna-lisa-alpha时提到一个很明显的变化:图片里的文字更不容易变形,同时写实度和噪点控制也有提升。
这意味着以后AI生图真正能干的活,会从头像、插画继续扩展到海报、公众号封面、PPT页面、广告图,甚至完整的UI和社交媒体素材。
对做内容的人来说,这个提升比“人物又真实了10%”实用得多。
02|照片里的“AI味儿”越来越淡
原稿里展示的村庄、人物、羊群和景深测试,已经越来越接近普通摄影照片;同一个角色连续生成时,人脸稳定性也被认为有所改善。
过去AI图片经常输在“太完美”:皮肤太干净、光线太规整、背景像布景。现在模型越来越会制造真实世界里的纹理、杂乱和轻微不完美。
这就有意思了。
以后单靠“看起来有AI味儿”去判断真假,会越来越难。
03|图片正在变成ChatGPT的重要入口
OpenAI今年4月上线ChatGPT Images 2.0后,已经把图片生成和编辑全面整合进ChatGPT,支持文字渲染、图片修改、透明背景等能力,并向所有套餐开放。
所以luna-lisa-alpha最后到底叫2.5、3.0,还是别的名字,其实没那么重要。
有一点已经很清楚:
OpenAI还会继续狠狠干生图。
夸完了,该泼的冷水还是得泼。
第一,“GPT Image 2.5”目前仍然是社区叫法,OpenAI没有正式发布这个名字,更没有公开API、价格和完整参数,别看到截图就直接当官宣。
第二,现在网上传播的主要还是成功案例,文字稳定性、中文表现、多人物一致性这些能力到底能不能稳定复现,要等正式开放以后再狠狠干一轮。
第三,模型越逼真,截图的可信度反而越低。以后看到“CEO发文”“内部邮件”“产品发布会截图”,最好先找原始链接,单张图片已经越来越难承担证据作用。
最后,老规矩,用三句话总结:
1. 这次神秘模型最值得看的,不只是画质,而是文字、人物、界面和真实感开始被同时做好,AI正在学会生成完整的“视觉信息”。
2. 目前的公开案例确实很猛,但“GPT Image 2.5”这个身份还没坐实,真正的稳定性也没有经过大规模验证,先别急着封神。
3. 对做内容的人来说,生图会越来越省事;对看内容的人来说,也得养成一个新习惯——截图可以看,关键事实一定去找原始来源。
这次我不准备普通的“生图提示词大全”了,直接给大家做两个能长期用的智能体。
🎁 《万能生图提示词智能体》:教你从零搭建一个自己的生图助手。你只需要告诉它“我要公众号封面、产品图、小红书照片、海报还是PPT配图”,它就会自动补全构图、人物、场景、镜头、光线和风格,生成可以直接复制的完整提示词。
🎁 《AI图片真实性检测智能体》:专门帮你检查可疑图片里的文字、人物、光影、界面、来源和逻辑问题,并告诉你下一步该去验证什么。
我把搭建提示词+使用方法+场景模板都整理好了。
扫码回复关键词【生图】,两个智能体一起发给你。

