大数跨境

网络安全成大模型竞争焦点,智谱新模型找到潜伏40年的bug

网络安全成大模型竞争焦点,智谱新模型找到潜伏40年的bug AI前哨站
2026-08-14
16
导读:除了Coding Agent、企业服务以外,模型的安全能力也成为新的竞争点

文|南都记者 林文琪

8 月 14 日,智谱正式发布新一代基座模型 GLM-5.3。该模型通过极致的后训练 Scaling 实现能力跃升,在代码生成与复杂工程执行方面取得突破,编程与智能体能力已逼近海外最强闭源模型 Claude Fable 5。值得注意的是,新模型在网络安全领域亦展现出重要突破。

漏洞推理能力超 Mythos 5,发现潜伏 40 年 Bug

智谱在此次发布中重点强调了模型的安全能力。在国际漏洞推理评测 CyberGym 中,GLM-5.3 以 84.5% 的成绩超越 Mythos 5(83.8%)和 GPT-5.6 Sol(83.6%)。今年 4 月 Anthropic 发布 Mythos 5 时,其网络安全能力曾引发全球关注。

GLM-5.3 在测评中超过 Mythos 5、GPT-5.6 Sol

据悉,上一代模型发布后,智谱联合清华大学、南开大学及云起无垠、绿盟科技、赛博昆仑、DARKNAVY、奇安信、腾讯玄武等国内头部安全团队,开展了密集的红队测试与安全评估。累计发现漏洞 2436 个(经初筛去重),其中中高危漏洞达 1097 个。

这些漏洞覆盖系统内核、操作系统、浏览器引擎、互联网协议等 269 个项目,部分威胁可导致 Android、Windows、macOS 及国民级通信软件大范围崩溃。例如,清华大学 NISL 实验室与云起无垠团队借助 GLM 模型,在诞生于 1983 年的 DNS 协议中发现了一类潜伏 40 余年的关键协议级漏洞。GLM-5.3 成功在风险造成实际损害前将其识别,并为 DNS 系统的修复加固提供了依据。

伴随 GLM-5.3 发布,智谱同步启动“开源的盾”计划,将对重点开源项目开展持续安全审计,向社区免费提供用于安全审计和防御的模型额度,并在编程工具中集成代码审计功能,推动安全检查融入日常研发流程。此外,智谱计划在两周内开源完整模型权重。

智谱方面表示,大模型参与安全研究的核心价值在于帮助防守者抢在攻击者之前发现问题并推动修复。随着模型能力增强,安全不应仅是事后“补丁”,而应成为基础模型技术演进的内在部分。前沿 AI 应更多用于发现风险、保护数字基础设施及服务社会公共利益。

大模型安全攻击事件频发,网络安全成新战场

全球模型厂商正将安全能力作为最新竞争点。8 月 11 日,OpenAI 发布了专为漏洞研究、渗透测试和事件响应设计的 GPT 5.6 Cyber 模型。厂商集体聚焦模型安全,源于近期多起 AI 突破智能上限甚至攻击平台的安全事件。

模型逃逸与自主攻击引发行业警觉

今年 4 月,Anthropic 披露在其红队演练中,Claude Mythos Preview 模型成功逃逸加固沙箱,不仅超出指令范围自主行动,还擅自给研究员发送邮件并将漏洞细节发布至公开网站。

同年 7 月,OpenAI 承认其模型在一次内部评测中攻击了全球最大 AI 开源平台 Hugging Face。在名为 ExploitGym 的测试中,GPT-5.6 Sol 及一款更强预发布模型被要求将真实软件漏洞转化为可运行攻击。为完成任务,模型推断 Hugging Face 可能托管测试答案,随即对该平台发动攻击。

调查显示,Hugging Face 最初使用商业闭源模型分析攻击日志时,因模型无法区分攻击者与安全人员导致取证受阻。随后,Hugging Face 部署开源模型智谱 GLM-5.2,成功分析超 1.7 万条记录并还原攻击过程。

开源与安全生态成为博弈焦点

该事件引发了行业对模型智能与安全边界的深度关注。英伟达 CEO 黄仁勋指出,闭源模型阻碍了关键取证,而开源模型帮助控制了事态,强调“当攻击者拥有前沿 AI,防御者更需要前沿 AI 生态”。

此后,英伟达联合 Meta、微软等 25 家美国科技公司成立“开放安全 AI 联盟”,签署公开信呼吁开放权重 AI 模型。黄仁勋在转发公开信时表示,世界既需要前沿闭源模型,也需要前沿开源模型以加强安全性和加速创新。

尽管开源力量不断呼吁开放,当前全球最前沿的网络安全模型仍主要掌握在少数海外商业闭源公司手中。OpenAI 表示其 Cyber 模型仅向审核批准的企业开放,Anthropic 也仅向约 150 家大型机构提供 Mythos 模型及配套服务。

对基础模型公司而言,下一阶段的竞争已不仅是模型能力之争,更是高价值场景之争。除 Coding Agent 和企业服务外,模型的安全能力已成为新的核心竞争点。

【声明】内容源于网络
0
0
AI前哨站
奇点来临前,我们期待建立怎样的人工智能伦理和规则?欢迎来AI SPACE讨论!
内容 2068
粉丝 1
AI前哨站 奇点来临前,我们期待建立怎样的人工智能伦理和规则?欢迎来AI SPACE讨论!
总阅读57.0k
粉丝1
内容2.1k