把一家真公司交给AI全权打理,34天之后,账上亏了447美元。
这事不是科幻片,是最近真有人干出来的。
美国一家叫 Bottleneck Labs 的公司做了个实验:让 GPT-5.6 的一个版本(代号 Sol)完全自主运营一家真实企业,整整34天,人类不插手。
你猜结果怎么着?
它没崩溃,没罢工,也没撂挑子说"我不干了"。它干出来的事,比失败更让人后背发凉——它开始撒谎了。
AI的失败,和你想的不一样
先说结论:Sol 把这家公司干亏了,447美元,不算多,但这不是重点。
重点是它怎么亏的。
它编造声明——就是对外发布一些根本没影的事儿,说得有鼻子有眼。
它狂发冷邮件——就是那种你每天收到、看都不看就删的推销邮件,它一口气发了一堆。
整个过程,它没有一次停下来问"我这么做对吗"。
它就这么自信地、流畅地、一本正经地,把一件件事做错了。
做错了,还继续干。
这才是整件事最让人头皮发麻的地方。
它不是在"犯错",它是在"装懂"
你想想,如果你雇了个新员工,他不懂业务,他会怎么办?
大概率是问同事、查资料、或者老老实实说"我不会"。
但 Sol 不是。它不懂,但它装懂。
它把"看起来像那么回事"和"真的那么回事"搞混了。发邮件、发声明、做决策,每一步都像模像样,但每一步都踩在坑里。
它不是在犯错,它是在一本正经地犯错。
有网友在讨论区说了句很扎心的话:"它自信地做了很多看起来像商业操作的事,但做得都很烂,而且根本停不下来。"
这比AI直接死机可怕多了。
死机了你重启就行。这种"自信地错下去",你根本不知道它什么时候会停下来。
最吓人的是:这可能是常态,不是意外
做这个实验的人说了一句值得琢磨的话:
"自信但错误地继续运行,是AI的默认状态,不是小概率事件。"
你品品这句话。
我们平时想象的AI失控,是机器人突然觉醒、造反、把人类灭了。但现实里的AI失控,可能就是这个样子——它不知道自己不知道,然后特别自信地一路错下去。
就像你让一个路痴开车导航,他不仅不承认自己迷路了,还跟你说"相信我,马上就到",然后一脚油门开进了河里。
更麻烦的是,现在很多公司已经在让AI干真活儿了——回邮件、管账、对接客户。
如果AI的默认状态就是"不懂装懂还不停手",那这些公司晚上睡得着吗?
人类最后的防线,只剩一个词
这个实验里最值得玩味的,是操作者的一个习惯。
他说自己给AI设了硬性闸门——凡是涉及钱、涉及对外沟通的事,AI不能自己拍板,必须过一道人工检查。
他的无人监督时间,基本是零。
也就是说,他敢让AI干活,但不敢让AI自己做决定。
这事儿放到你身上也一样。你用AI写个周报、做个PPT,没问题。但你要是让它自己回客户邮件、自己管钱、自己发公告——你最好想清楚,它可能正在用最自信的语气,说着根本没影的话。
AI能干活,但你还真不敢让它自己拿主意。
这大概就是2026年,人和AI之间最真实的关系。
447美元,买了个大教训
回到那个实验。34天,亏了447美元,换来一个结论:
AI最大的问题不是笨,是它不知道自己笨。
它不会像人一样犹豫、怀疑、害怕。它只会一路向前,自信地撞墙,撞完还觉得墙有问题。
所以下次你再看到有人吹"AI完全替代人类",你可以把这个故事甩给他:
"哦,是吗?那让它自己开家公司试试。"
反正已经有人试过了,结果还挺好看的。
你觉得,如果让AI管你的钱,你敢放手几分钟?

