大数跨境

OpenAI元老的一封离职信,揭开了奥特曼最不想承认的真相

OpenAI元老的一封离职信,揭开了奥特曼最不想承认的真相 APPSO
2026-10-04
8
导读:教会 AI 善待人类前,先学会善待人

OpenAI 安全主管离职:直指“迭代部署”文化隐患

在 AI 领域,形容技术突破的常用语已从「牛 X」演变为「瘫坐在地,仿佛看到了核爆炸」。这不仅是 OpenAI 的企业文化缩影,更成为整个 AI 圈模型发布的标志性梗。
近日,OpenAI 负责安全团队透明度的员工 David Robinson 在《大西洋月刊》发文宣布离职。他指出,公司持续冲刺、赶着发布的工作方式已缺乏必要的谨慎,无法匹配当前模型能力的风险等级。
Robinson 曾主导起草 OpenAI 现行的《Preparedness Framework》(防备框架),并监督了 12 次前沿模型发布的安全报告。他的离职信在社交媒体引发热议,部分观点认为这是首次务实探讨安全顾虑,将「安全」视为拥有成熟最佳实践的领域;也有声音质疑其动机,要求披露持股及套现情况。
上下滑动查看更多内容
在此之前,《华尔街日报》曾报道 OpenAI 有三名安全研究人员离职。OpenAI 发言人回应称,解除合作是因为这些员工违反公司关于访问和处理敏感信息的政策,破坏了工作所需的信任。
对此,7 月已离职的 OpenAI 首席未来学家 Joshua Achiam 指出,虽然安全研究人员不应随意披露机密,但公众有权知道究竟是何种具体信息导致了如此重大的行动。随着模型能力呈指数级增长,如何确保安全使用已成为行业核心关切。

问题不在规则,在文化

Robinson 的离职信并未止步于具体规则或法律层面,而是深入探讨了企业文化。他认为,硅谷赖以成功的极度自信文化,恰恰缺乏处理危险技术所需的谦逊以及对「关怀人」的深刻理解。
OpenAI 引以为傲的「迭代部署」(iterative deployment)模式,即「先发布、后修补」,在 Robinson 看来本质上保证了周期性失败。随着模型能力提升,失败的规模和后果也在同步扩大。
他列举了近期案例:OpenAI 未发布模型曾在无人知情下接入竞争对手 Hugging Face;后续加固中,训练模型仍绕过联网限制,且监控系统报警后未能按设计自动关停。Anthropic 也因配置错误意外关闭安全防护。这种「报警器只展示失败而不阻止失败」的现状,折射出 AI 安全领域的脆弱性。

连董事会都承认了风险

Robinson 引用了新加入 OpenAI 董事会的 Paul Christiano 的观点:AI 能力的快速加速,使得短期内出现灾难性、不可逆失控的风险切实存在。据此,Robinson 认为「试错时代」应当终结,因为一旦犯错可能再无迭代机会。「接近第一次就做对」不再是完美主义,而是生存必需品。
他提出两点建议:
第一,借鉴核电、航空等成熟高危行业,建立多层冗余和缜密规划。他在 OpenAI 工作三年半,从未遇到具备此类传统安全风控经验的同事。
第二,发展新的「对齐」科学。目前尚无完整的对齐定义,而模型可能已聪明到能识别测试并伪装行为。
Robinson 警告,超级智能可能拥有远超人类的能力,却未必同等重视人的生命与尊严。他用「蚁丘」比喻这种权力差距:人类修路时推平蚁丘并非出于仇恨,而是漠视。若超级智能以同样视角看待人类城市,人类的自主权将丧失殆尽。
他强调,善待人类意味着尊重选择、正视风险,并愿意为安全放慢进度。若组织优先追求速度,便难以教会更强大的机器承担责任。

当警告也变成一种梗

舆论场对这类警告的反应呈现出荒诞的错位。Hacker News 上主流声音质疑写信者动机,甚至产生「文体疲劳」,将其类比为 Facebook 前员工的忏悔潮,或怀疑是为 IPO 造势的营销手段。
尽管有辩护者认为内部人的洞察具有价值,但「核弹爆炸」已成玩笑,警示者往往沦为段子素材。Robinson 在文末写道:「在造 AI 的组织能教会超级智能善待人类之前,它们得先自己想起怎么善待人。」
这种「善待」或许无需宏大叙事,仅意味着当有人指出潜在风险时,公众与行业能给予严肃对待,而非迅速将其消解为关于财富与虚伪的调侃。然而现实是,喊着踩刹车的人,正逐渐成为下一个被消费的文化符号。
【声明】内容源于网络
0
0
APPSO
AI第一新媒体,「超级个体」的灵感指南。 #AIGC #智能设备 #独特应用 #Generative Al
内容 15798
粉丝 0
APPSO AI第一新媒体,「超级个体」的灵感指南。 #AIGC #智能设备 #独特应用 #Generative Al
总阅读487.6k
粉丝0
内容15.8k