朋友们,周末我蹬了整整 2 天 GPT-6。
最后很艰难的把自己从里面拔了出来,等心绪彻底平复下来,我才来写的这篇文章。
熟悉我的朋友们都知道,我大部分文章标题都喜欢带着实测两个字,这倒不是刻意立的人设。
我是一名北漂了 10 年的大厂程序员,干这行干久了就会留下这个习惯。
因为一个功能从演示 Demo 到真正能交付,中间隔着的鸿沟有多深,我太清楚了。
所以自己没上手之前,我不会对一个技术产品妄下断言。
这两年 AI 圈儿有个现象,一个模型发布之后,第一时间冲出来的往往不是实测过的人,是最会营造恐惧,贩卖焦虑的人。
什么谁谁谁又放大招了,谁谁谁太炸裂了,谁谁谁又要失业了。
读者看完要么热血沸腾,要么不知所措。
关掉页面之后,什么都没学到,也不知道该拿它干什么,反正流量是有了。
但是我想说,AI 这个东西不要光听别人讲,只有你亲自用过,才会得出属于你自己的判断。
作为创作者也要负起责任,因为你的一句话可能会影响很多人,这也是为什么我一直坚持写实测文章的原因。
那么话不多说,咱们边测边聊。
实测
第一个实测案例是我最想先讲的。
因为它把这一代模型最重要的变化,全都串起来了。
我让它在 Blender 里做一个小米 SU7 Ultra 的 3D 模型,然后在网页里用这台车的模型,做一款类似《巅峰极速》那种写实风格的 3D 竞速游戏。
直接来看结果,我录屏了两个视频,加上了背景音乐。
在 Blender 里建模的结果是这样的。
在网页里的游戏,是下面这样的。
我自己是不会用 Blender 的,整个过程我都没有动手干预,只是第一次建模的时候,效果不是很理想,我让它又优化了一次。
不知道你此时此刻看完是什么感受,当时可把我兴奋坏了。
再来简单解释下,能够完成这不可思议的一切,除了新一代模型的能力外,还要算上 Blender MCP,Computer use 和 Browser use。
前者,相当于给 AI 装上了一套 Blender 的官方直连插头。
让它能像资深老手一样,绕过复杂花哨的界面,直接精准操控软件底层的 API。
后两者是电脑和浏览器使用能力,相当于给 AI 安上了一双能看屏幕的眼睛,和一双会用鼠标键盘的手,让它能够自主在电脑操作系统和网页浏览器之间工作。
这次 GPT-6 模型的提升,让这些能力也变得更好用了。
这才有了更快更好的,3D 建模和编程验证的自动化能力。
这种好像 AI 可以自主操作一切东西完成复杂任务的感觉,也就是所谓的 AGI 来了的感觉。
第二个案例,我让它在浏览器里创建一个极其精细的实时 3D 森林。
这回是一次直出的效果,我同样添加了背景音乐,你来看录屏视频感受下。
一片打开就能进入,可以自由穿行,自由升降的实时计算生成的 3D 森林。
约有 750 棵树,25 万簇草,还有各种蕨类,灌木,野花,蘑菇,岩石等等。
暖色的阳光穿过树冠缝隙,被薄雾散射,甚至还能看出丁达尔效应。
说真的,我还没见过哪个模型交出过这个水平的东西。
接下来的两个实测案例,还是游戏。
3D 看完了,咱们换个维度,看看 2D。
我让它做了一款中国古风的 2D 战斗游戏,先来看效果。
具体呈现的是一个可以通关的序章,图片素材用的是 Codex 内置的 OpenAI 图像生成工具 imagegen 生成的。
各种技能连招可以从地上打到天上,整体的操作感很丝滑,打击感相当不错。
画面上它用的是 2.5D 分层渲染,镜头动的时候有纵深的感觉。
下面一个,我让它致敬下童年的回忆《仙剑奇侠传》 游戏,复刻一个像素风可以在浏览器里运行的版本。
整体交付的结果很完整,包括剧情,结伴,开箱,采药和战斗。
你还别说,配上音乐之后,真有点把我带回去的感觉。
测完这几个案例之后,我有种非常强烈的感觉。
GPT-6 这一次做出来的东西,好像真的把从演示 Demo 到真正能交付中间的鸿沟,给填平了。
还没完,还有咱们的一系列保留节目。
分别是 3D 火山喷发模拟,之前跟 Three.js 官方互动过的跳舞测试,和像素樱花塔。
如果你是追更过来的老朋友,有了过去模型的效果参照,相信看完之后,你自然会得出这个结论。
GPT-6 的表现确确实实夯爆了。
咱们一个一个快速看一下。
先来看 3D 火山喷发模拟,我加上了跟 Fable 5.1 的对比,你来感受一下。
GPT-6 的产出有着丰富的喷发层次,特别是岩浆沿着山坡的流动感。
我只能说,在这个案例上,GPT-6 扎扎实实的把 Fable 5.1 锤爆了。
再来看之前跟 Three.js 官方互动过的人物跳舞测试。
无论是人物造型,舞蹈动画还是视觉氛围,都是这个案例我见过的最佳表现了。
最后来看像素樱花塔。
虽然看上去不大,但整整包含了 22000 多个彩色像素块。
它还能切换时间,从清晨到白天再到夜晚。
放大之后,你还能看到游动的锦鲤,飘落的花瓣,甚至还有萤火虫。
各种细节拉满了。
最后,我又简单测试了一下写作。
你读一读感受下,细思极恐。
全部实测完之后,我刷到了行业权威测评 Arena 的前端开发排行榜。
结合我的实测,看到这个排名就一点也不意外了。
尾声
我有一个价值观,人要始终站在机器之上。
这个周末,它第一次被 GPT-6 动摇了。
我反复思考了很久,好在最后想明白了。
目前这套 AI 再强大也是自回归的,它学了全人类的语料,然后不断回归到人类的均值。
而人之所以为人,恰恰不在于提供均值,在于提供异常值。
也就是说,人类给出的可能是它自己永远也算不出来的那个偏差。
更何况,机器可以做成一件事,但它不承担这件事,责任还是在人身上。
再往深一层说,上面所有的实测案例都是我想要做出来的。
机器不会想要什么,它所有的想要都是人给的。
所以站在机器之上,不代表能力,而是说的位置。
谁来出题,谁来纠偏,谁来提供异常值,谁来为结果负责,谁来赋予这件事意义。
只要这些还掌握在人类手中,机器再强也是为我们所用的工具。
但这个位置有一点很危险,因为它是可以让出去的。
当你懒得验收了,当你连自己想要什么都让它替你想了,当你也开始只提供出均值。
这个位置就空了,所以站在机器之上,说到底是一种在场,你需要一直站在那里才行。
所以,要感谢 GPT-6 突然变得这么强,我们更清楚自己该做什么了。
你想让它替你做什么?
这个问题,谁也无法替你回答。
既然你看到这里了,如果觉得不错,请帮我一键三连,转发给你的朋友,这真的对我很重要。
另外如果想第一时间收到推送,请将本公众号加个星标🌟
谢谢你看我的文章,祝你有财安康,我们下期见。

