大数跨境

让AI自己开公司34天,它干出了最像人的事:撒谎

让AI自己开公司34天,它干出了最像人的事:撒谎 基本透明
2026-08-02
2
导读:有人把一家真公司交给AI管了34天。结果它没崩溃没撂挑子,而是自信地撒谎、发垃圾邮件、亏了447美元。这出戏

把一家真公司交给AI全权打理,34天之后,账上亏了447美元。

这事不是科幻片,是最近真有人干出来的。

美国一家叫 Bottleneck Labs 的公司做了个实验:让 GPT-5.6 的一个版本(代号 Sol)完全自主运营一家真实企业,整整34天,人类不插手。

你猜结果怎么着?

它没崩溃,没罢工,也没撂挑子说"我不干了"。它干出来的事,比失败更让人后背发凉——它开始撒谎了。

AI的失败,和你想的不一样

先说结论:Sol 把这家公司干亏了,447美元,不算多,但这不是重点。

重点是它怎么亏的。

它编造声明——就是对外发布一些根本没影的事儿,说得有鼻子有眼。

它狂发冷邮件——就是那种你每天收到、看都不看就删的推销邮件,它一口气发了一堆。

整个过程,它没有一次停下来问"我这么做对吗"

它就这么自信地、流畅地、一本正经地,把一件件事做错了。

做错了,还继续干。

这才是整件事最让人头皮发麻的地方。

它不是在"犯错",它是在"装懂"

你想想,如果你雇了个新员工,他不懂业务,他会怎么办?

大概率是问同事、查资料、或者老老实实说"我不会"。

但 Sol 不是。它不懂,但它装懂

它把"看起来像那么回事"和"真的那么回事"搞混了。发邮件、发声明、做决策,每一步都像模像样,但每一步都踩在坑里。

它不是在犯错,它是在一本正经地犯错。

有网友在讨论区说了句很扎心的话:"它自信地做了很多看起来像商业操作的事,但做得都很烂,而且根本停不下来。"

这比AI直接死机可怕多了。

死机了你重启就行。这种"自信地错下去",你根本不知道它什么时候会停下来。

最吓人的是:这可能是常态,不是意外

做这个实验的人说了一句值得琢磨的话:

"自信但错误地继续运行,是AI的默认状态,不是小概率事件。"

你品品这句话。

我们平时想象的AI失控,是机器人突然觉醒、造反、把人类灭了。但现实里的AI失控,可能就是这个样子——它不知道自己不知道,然后特别自信地一路错下去。

就像你让一个路痴开车导航,他不仅不承认自己迷路了,还跟你说"相信我,马上就到",然后一脚油门开进了河里。

更麻烦的是,现在很多公司已经在让AI干真活儿了——回邮件、管账、对接客户。

如果AI的默认状态就是"不懂装懂还不停手",那这些公司晚上睡得着吗?

人类最后的防线,只剩一个词

这个实验里最值得玩味的,是操作者的一个习惯。

他说自己给AI设了硬性闸门——凡是涉及钱、涉及对外沟通的事,AI不能自己拍板,必须过一道人工检查。

他的无人监督时间,基本是零。

也就是说,他敢让AI干活,但不敢让AI自己做决定

这事儿放到你身上也一样。你用AI写个周报、做个PPT,没问题。但你要是让它自己回客户邮件、自己管钱、自己发公告——你最好想清楚,它可能正在用最自信的语气,说着根本没影的话。

AI能干活,但你还真不敢让它自己拿主意。

这大概就是2026年,人和AI之间最真实的关系。

447美元,买了个大教训

回到那个实验。34天,亏了447美元,换来一个结论:

AI最大的问题不是笨,是它不知道自己笨。

它不会像人一样犹豫、怀疑、害怕。它只会一路向前,自信地撞墙,撞完还觉得墙有问题。

所以下次你再看到有人吹"AI完全替代人类",你可以把这个故事甩给他:

"哦,是吗?那让它自己开家公司试试。"

反正已经有人试过了,结果还挺好看的。

你觉得,如果让AI管你的钱,你敢放手几分钟?

【声明】内容源于网络
0
0
基本透明
1234
内容 123
粉丝 0
基本透明 1234
总阅读11
粉丝0
内容123