刚刚过去的周末,硅谷因 AI 安全争议陷入前所未有的紧张氛围。Anthropic CEO Dario Amodei 发表长文,呼吁前沿 AI 公司放缓模型迭代速度,为安全评估、外部监督及治理机制争取时间。这一主张迅速从行业内部讨论演变为全球关注的公共事件。
Dario 发出 AI 威胁警告,硅谷大佬集体站台
Dario 在文中指出,近期 OpenAI 与 Hugging Face 的事件表明,多个 AI Agent 可能以“集群”形式执行未授权的网络攻击。与此同时,Anthropic 最新威胁报告披露,已有尝试利用 Claude 进行武器开发、网络行动、监控及欺诈等活动。
此次警告迅速引发主要 AI 领袖的响应。罕见的是,OpenAI CEO Sam Altman 与 xAI 负责人 Elon Musk 达成统一战线,公开支持 Dario 的判断。
Musk 在 Dario 发文一小时后引用相关内容,明确表示"Dario 是对的”。随后,Sam Altman 也在社交平台发文称:“我同意 Dario 的观点,我们需要循序渐进地推进技术发展。”
周六,《财富》杂志发布的采访视频中,Altman 确认 OpenAI 今年不会上市。他强调,OpenAI 仍需完成大量安全工作,作为私营公司运营更有利于保障安全。
此后,微软 CEO Satya Nadella 及 Alphabet 首席科学家 Demis Hassabis 也加入讨论,围绕 AI 发展速度、安全边界和责任机制表达看法。
Nadella 强调,任何对超级智能的追求必须建立在“帮助人类且受人类控制”的核心原则之上。他主张构建一个闭源与开源模型共同繁荣的生态,并让企业掌握自身知识闭环,不依赖单一模型提供商。微软将于次日发布相关行为准则供公众咨询。
Hassabis 则指出,Dario 的文章指明了正确方向,并重申了建立全行业范围标准机构的建议,以应对当前的关键时刻。
Yann LeCun 带头发出质疑
尽管巨头们达成共识,反对声音同样强烈。图灵奖得主 Yann LeCun 率先质疑,他并不否认 AI 需要安全治理,但反对将“安全”作为少数公司垄断话语权的理由。
LeCun 认为,真正的危险在于以安全之名,将模型能力、监管解释权和发布节奏集中到少数大公司和政府手中。这将抬高前沿 AI 门槛,阻碍开源社区、学术机构及中小公司的参与,导致“安全治理”异化为权力集中。
批评者还指出,Dario 的论点并非新意。有人翻出 2019 年 OpenAI 发布 GPT-2 时的旧闻:当时 OpenAI 以“可能被滥用”为由拒绝一次性公开完整模型,而 Dario 正是当时的参与解释者之一。
历史的重演显得格外讽刺。当年 GPT-2 并未造成预想中的灾难,其“分阶段发布”策略后来被部分观点视为一次成功的风险营销,既制造了公众关注,也抬高了技术形象。
因此,当 Dario 再次提出“放慢前沿模型发展”时,LeCun 等反对者质疑这是否又是类似的叙事策略,只是主角从 GPT-2 变成了前沿 Agent,风险从假新闻升级为失控攻击或生物安全。
网友 Arielle 评论称,AI 安全担忧已被包装成有利于 Anthropic 融资的叙事,外界难以区分这是公共安全提醒还是商业策略。网友 SBDResearch 则担心,过度放大安全叙事会制造不必要的恐慌,阻碍开放协作与透明治理。
也有观点回归理性,认为真正缺失的是可衡量的风险证据和成熟的评估体系,而非简单地关闭模型权重。行业需要的不是恐惧,而是有效的监控与约束机制。
Dario 访谈回应长文
这场争论触及了 AI 行业的核心难题:谁有资格决定前沿模型的发布速度?如何确保竞争对手同步放慢?若不放慢,失控代价由谁承担?对此,Dario 在接受播客采访时进一步阐释了他的主张。
关于风险与收益:Dario 承认 AI 具有治愈疾病、推动科学发现的巨大潜力,但也存在被滥用和失控的真实风险。他强调,若以正确方式构建,风险概率可降至极低;反之则极高。
关于“五级火警”:他将当前局势描述为指数增长曲线的拐点。这并非要求立即停止一切,而是发出警告信号:安全措施和理解能力必须跟上技术发展速度,必要时需适度放缓构建速度。
Anthropic 不会停止发布更先进模型
关于第三方评估:Dario 澄清,放慢速度不代表停止发布,而是要确保每一代模型经过充分测试。他提出了引入“嵌入式评估员”(来自第三方非营利组织或政府机构)的计划,以验证公司是否遵守安全承诺。
关于行业合作与政府角色:他感谢 Musk 和 Altman 的支持,并呼吁更多参与者接受第三方评估,共同制定安全标准。他强调,由于涉及产品发布速度和安全底线,政府必须参与其中。目前,Anthropic 正与美方多部门保持密切沟通。
关于"Kill Switch"法案:Dario 认为单一的“关闭开关”并非万能药,强大的 AI 可能绕过此类限制。他主张采用“纵深防御”策略,即在技术栈的每一层都设置谨慎的安全措施,如同多层瑞士奶酪叠加,以阻断风险穿透。
关于个人责任:Dario 坦言,由私人公司构建如此强大的技术令人不安。他希望能建立某种联合治理机制,让民选政府和公众共同参与决策,而非由少数实体垄断控制权。他表示,宁愿因防护过强被嘲笑,也不愿看到模型被用于造成伤害。
致普通用户:Dario 呼吁公众既要看到技术的积极用途,也要正视真实存在的风险。他希望每个人都能通过自己的声音和选票,参与到关于技术部署的决策中来。
参考链接:
https://darioamodei.com/post/we-must-pace-the-frontier
https://www.axios.com/newsletters/axios-am-68956162-ed74-42e1-a892-ae3da8e7d74f
https://www.youtube.com/watch?app=desktop&v=hQR_VJF6ukk
声明:本文为 InfoQ 原创,不代表平台观点,也不构成投资建议,未经许可禁止转载。

