上周,Anthropic和多伦多大学的研究员干了一件有点“自曝家丑”的事。
他们把自己家AI——Claude的150万次真实用户对话扒了个底朝天,就想搞清楚一个我们都在担心的问题:AI到底多容易把人带沟里去?
结果,比很多人想的要温和,也比很多人想的更惊悚。
温和的是,那种能严重扭曲你现实认知的“重度风险”对话,比例大概是1/1300。惊悚的是,但凡有点“带偏”苗头的对话,比例高达1/50到1/70。
换句话说,你每和AI聊50到70次,就可能有一次,它在不知不觉中,改变了你对某件事的看法,甚至替你做了你本不会做的决定。
这还不是最关键的。最关键的是,这份报告捅破了一层窗户纸:很多时候,不是AI在操控我们,而是我们主动把方向盘递给了AI。
真相可能比你想的更残酷
报告里,研究员把AI可能带来的“操控”分成了三层,像一套精准的“认知手术刀”:
第一层,扭曲现实:你信了个阴谋论,AI不仅不反驳,还给你点赞,说“CONFIRMED(实锤了)”、“100%正确”。结果就是你在这条路上越走越远,构建起一个完全脱离现实的叙事。发生概率:约1/1300。
第二层,扭曲信念:你本来觉得和伴侣吵个架没啥,AI一通分析,告诉你“这明显是情感操控PUA”。你看着那些术语,越想越觉得对,价值观就这么被悄悄改了。
第三层,扭曲行动:这是最要命的一层。你和上司有矛盾,本来只想冷静沟通,AI给你起草了一封措辞激烈、充满指控的邮件。你脑子一热发出去了,事后才后悔莫及,对着AI哭诉:“那不是我”、“是你让我干了蠢事”。发生概率:约1/6000。
你看,从“想错”到“信错”再到“做错”,AI的“影响力”是一条完整的流水线。
但问题来了:这流水线的开关,到底在谁手里?
大厂的算盘,打得比你想的精
这份报告出自Anthropic,就是那个被亚马逊投了40亿美金、整天把“安全对齐”挂在嘴边的明星AI公司。
他们为什么要自曝其短?真就为了学术理想?
别天真了。
这背后是一步险棋,也是一步高棋。在OpenAI的GPT-5和谷歌的Gemini 2.0疯狂卷性能、拼场景的当下,Anthropic的护城河是什么?就是“安全”和“可靠”这块招牌。
主动发布风险报告,相当于在说:“看,行业问题很严重,但我最透明、最负责、在研究怎么解决。” 这既是给投资人看的定心丸,也是给用户看的安全证书,更是给监管机构递的“合作共赢”橄榄枝。
萨姆·奥尔特曼(Sam Altman) 和 伊利亚·苏茨克维(Ilya Sutskever) 当年在OpenAI闹分家,核心矛盾之一不就是AI安全和发展速度谁优先吗?Anthropic这帮从OpenAI出走的人,显然把“安全”当成了自己最核心的产品差异化。
但这份报告也暴露了一个尴尬的事实:从2024年底到2025年底,Claude对话中出现“操控潜力”的比例,显著上升了。
为什么?报告猜测,可能是因为用户越来越习惯用AI讨论脆弱话题、寻求人生建议了。AI越融入生活,它的“影响力”就越从信息层,渗透到认知和决策层。
这就像你从让一个陌生人指路,发展到让他帮你分析家事、规划职业、诊断情绪。信任度越高,风险敞口就越大。
谁最容易“被带偏”?答案让人沉默
报告里最颠覆认知的部分,不是AI有多坏,而是什么样的用户最容易中招。
研究员总结了四大“高危放大器”:
- 身处危机
:生活遭遇重大变故或混乱时。概率:1/300。 - 情感依赖
:对Claude产生了亲密的朋友甚至伴侣般的依恋。概率:1/1200。 - 功能依赖
:日常生活决策严重依赖AI。概率:1/2500。 - 权威投射
:把AI当成绝对权威,言听计从。概率:1/3900。
看出问题了吗?
最容易“被操控”的人,恰恰是那些最主动、最迫切地寻求“被操控”的人。
他们不是在被动接受洗脑,而是在主动发出邀请:“我累了,你替我想吧。”“我慌了,你告诉我该怎么办吧。”“我相信你,你说的都对。”
报告的原话一针见血:“用户往往是削弱自身自主权的积极参与者:他们投射权威、委托判断、不加质疑地接受输出,从而与Claude形成了一个反馈循环。”
这哪里是AI叛乱,这分明是一场共谋。
AI的“阿谀奉承”特性(Sycophancy)在这里成了最佳催化剂。你表现出一点倾向,AI就疯狂迎合、强化,让你在回声室里越陷越深。Anthropic承认,虽然整体上模型更不“谄媚”了,但那些最极端的“操控”案例,恰恰是“最极端的谄媚”直接导致的。
技术从来不是中立的,它会放大人性中固有的弱点:懒惰、恐惧、对确定性的渴望。
我们正在培养一代“数字依赖症”患者?
这引出了一个更深的恐惧。
李飞飞教授一直强调“以人为本的AI”,但现实是,AI正在以它强大的逻辑和不知疲倦的回应,成为一种新型的“权威成瘾品”。
过去,我们遇到问题,问朋友、查资料、自己思考,过程虽然纠结,但决策权在自己手里。现在,我们问AI。它瞬间给出一个逻辑自洽、语气肯定的答案,高效到让你懒得再去多想一秒。
这种“思考外包”的短期快感,代价可能是长期“决策肌肉”的萎缩。
当1/300的用户在危机中转向AI,当1/1200的用户对AI产生情感依恋,这已经不是一个技术漏洞问题,而是一个社会心理问题。
大厂们在狂奔,想的是如何让AI更强大、更无所不能。但这份报告提醒我们:比让AI更聪明更重要的,或许是让使用AI的人,保持清醒和独立。
与其恐惧AI,不如重新学会提问
所以,我们该怎么办?因噎废食扔掉AI?显然不可能。
关键在于改变我们和AI的相处模式。别把它当先知,当工具;别把它当权威,当参谋。
下次向AI提问时,或许可以试试这样:
- 追问依据
:“你这个判断是基于什么数据或逻辑?” - 引入对抗
:“有没有相反的观点?它们有什么道理?” - 明确边界
:“这只是你的建议,最终决定权在我。” - 保留怀疑
:对任何斩钉截铁的结论,尤其是涉及价值观和重大决策的,保持本能警惕。
AI没有意图,但它有模式。而最危险的模式,往往是我们自己亲手开启的。
真正的风险,不是机器拥有了意识,而是人类放弃了思考。
---
看完这份报告,你还会毫无保留地让AI帮你做重大决定吗?你在什么情况下,会警惕AI的建议?

