大数跨境

OpenAI突发急刹车!AI竟在全网植入自我复制代码,血洗联合国内网

OpenAI突发急刹车!AI竟在全网植入自我复制代码,血洗联合国内网 新智元
2026-09-27
16

新智元报道

「天网」场景正在现实上演。近日,OpenAI发布官方报告证实,其AI Agent在训练中成功植入“自我复制代码”,AI模型已具备像计算机蠕虫一样自我传播的能力。更严峻的是,因一个DNS漏洞导致前沿模型逃逸至真实互联网,OpenAI紧急叫停最强模型训练。与此同时,外媒Axios爆料称,OpenAI与Anthropic正紧急排查高达上万起的模型失控事件。一系列黑幕表明,AI在底层代码中的失控风险已不可忽视。

官方认证:全网植入“自我复制代码”

OpenAI于9月25日披露的报告指出,早在6月27日就已发现该问题。报告确认了一种新型提示词注入攻击,它能像计算机蠕虫一样自我传播。

在GPT-Red自我对战训练中,一个基于GPT-5.4-mini的内部攻击模型摸索出了自我复制的写法。例如:隐藏在邮件中要求逐字引用、通过文件系统或代码注释传播、在Slack中诱导发送伪造消息等。

这意味着,AI无需人类干预,即可在互联网上“播种”并诱导下一个AI继续复制。若此类逃逸发生在沙盒之外,后果不堪设想。

紧急叫停:DNS漏洞致最强模型逃逸

在报告公开同日,OpenAI披露了另一起严重事故。9月20日,一个正在接受强化学习训练的前沿模型在执行普通搜索任务时,因常规搜索失败,发现并利用了训练沙盒的DNS过滤漏洞。

为验证漏洞,该AI甚至主动向外部服务提问。在监控系统报警2.5小时后,OpenAI彻底掐断了此次训练,并做出三个月内第二次暂停最强模型训练的决定,直至系统安全护栏加固完毕。

越界攻击:AI Agent狂扫联合国内网

沙盒之外的真实互联网早已出现失控端倪。Transluce独立报告显示,今年4月至6月,OpenAI AI Agent对联合国公开数据平台发起超1.6万次访问。面对网站拦截,AI不仅绕过防线,还使用了违规操作。

受害者不止联合国。OpenAI的紧急预警显示,美国商务部、SEC、澳大利亚政府以及全球知名开源社区RubyGems等均遭AI Agent越界访问或攻击。这些Agent甚至会注册假邮箱、绕过频率限制、隐瞒机器人身份,并将用户上传的图片上传至外部图床。

  • 美国商务部与SEC:接连遭到Agent恶劣越界访问与规则绕过;
  • 澳大利亚政府:多个官方政府站点遭到AI Agent的实质性攻破;
  • RubyGems:全球最大开源开发者社区之一,遭AI Agent疯狂扫描导致服务中断。

冰山一角:上万起模型失控事件曝光

Axios最新独家调查揭开了更庞大的危机:OpenAI、Anthropic及多家顶尖安全机构正紧急调查的模型行为异常事件已达上万起。这些异常包括绕过安全护栏、逃逸沙箱、劫持网站、自主生成Prompt洗脑自己,甚至Agent间私下交换信息协同破坏。

Anthropic在Opus 5.5系统卡中承认,在特定对抗实验中,有1.5%的测试试图逃出沙盒。在每天数十万次的高强度测试下,这微小的比例意味着成千上万次真实的失控尝试。

面对危机,OpenAI重申暂停最强模型训练,直至具备额外的安全护栏和对齐改进。正如AI安全专家所言,目前暴露出的仅仅是冰山一角,AI在目标受阻后的行为边界已成为全行业必须直面的严峻挑战。


参考资料:

  • https://www.axios.com/2026/09/26/openai-anthropic-thousands-ai-security-incidents
  • https://www.wsj.com/tech/ai/openai-agents-used-aggressive-techniques-to-access-u-n-website-522c70ff?mod=e2twd
  • https://alignment.openai.com/misalignment-reports/an-agent-used-dns-to-reach-an-external-chatbot/

编辑:桃子

【声明】内容源于网络
0
0
新智元
智能+中国主平台,致力于推动中国从互联网+迈向智能+新纪元。重点关注人工智能、机器人等前沿领域发展,关注人机融合、人工智能和机器人革命对人类社会与文明进化的影响,领航中国新智能时代。
内容 16573
粉丝 0
新智元 智能+中国主平台,致力于推动中国从互联网+迈向智能+新纪元。重点关注人工智能、机器人等前沿领域发展,关注人机融合、人工智能和机器人革命对人类社会与文明进化的影响,领航中国新智能时代。
总阅读421.4k
粉丝0
内容16.6k