新智元报道

黄仁勋近期连续发布两条动态,引发行业震动。第一条是联合 32 家公司签署公开信,力挺开放权重模型;第二条正式官宣成立「开放安全 AI 联盟」(Open Secure AI Alliance),汇聚 37 家创始成员,涵盖芯片厂商、云巨头、安全公司及开源社区。
其核心论点明确:世界需要闭源与开源模型并存,但在网络安全领域,开源模型与安全测试框架(harness)不可或缺。
值得注意的是,联盟名单中缺席了 OpenAI、Google 和 Anthropic。面对局势变化,OpenAI 与 Google 迅速补签了公开信,唯独 Anthropic 既未签字也未入盟,成为唯一“局外人”。
37 家巨头集体下场,开启开放安全之战
黄仁勋发帖 8 小时内,众多 CEO 集体站台,阵容豪华。成员包括英伟达、微软、IBM、思科、CrowdStrike、Cloudflare、Hugging Face、戴尔、Palantir、Salesforce、SAP、SpaceXAI 等。
其中,英伟达贡献最为关键。其推出的 NOOA 框架(NVIDIA Labs Object-Oriented Agent)已在 GitHub 开源。该框架将智能体视为 Python 类:方法即能力,字段即状态,文档字符串即提示词。实测数据显示,其在 SWE-bench Verified 得分为 82.2%,CyberGym L1 解决率达 86.8%,ARC-AGI-3 达 85.1%,且 Token 消耗仅为对比方案的一半。
其他成员亦各展所长:
· HPE 提供 SPIFFE/SPIRE 零信任身份框架,解决智能体身份与权限难题。
· Hugging Face 贡献 Safetensors 安全权重格式,防止模型文件被篡改。
· IBM 与 Red Hat 联合推出 Lightwell 供应链数字签名补丁,保障模型分发完整性。
· 微软贡献 MDASH 多模型智能体扫描框架,用于安全测试。
· SpaceXAI 开源 Grok Build 终端 AI 编码智能体,并计划开源 Grok 系列权重。
这一行动背后的逻辑清晰:智能体安全不仅依赖模型权重,更涉及身份认证、权限管理、测试框架、护栏、日志及评估的全链条。唯有全栈开放,防御者才能审查、测试并加固每一层防线。若仅依赖黑盒 API,一旦攻击者突破护栏,防御者将束手无策。
两份名单撕开三大阵营
从公开信到联盟成立,短短两天,AI 行业格局已划分为三大阵营。
第一阵营:全面拥抱开放
既签署公开信又加入联盟。包括英伟达、微软、Meta、思科、戴尔、Hugging Face、IBM、Palantir、SpaceXAI 等。这些企业不仅支持开放权重理念,更愿将模型、身份体系、安全扫描及审计工具纳入联盟生态。
第二阵营:口头支持,行动保留
签署公开信但未加入联盟。代表为 OpenAI 和 Google。二者虽在公开信中向开放权重示好,但对深入参与“开放安全”联盟持保留态度。尤其是 OpenAI,因近期模型安全事故频发,签署公开信仅为补救举措,短期内难以加入以“开放”为核心的联盟。

第三阵营:坚定拒绝
既未签署公开信也未加入联盟,仅有 Anthropic 一家。CEO Dario Amodei 发表声明,虽称“从未主张禁止开放权重”,但随即强调三个重点打击方向:封锁芯片、杜绝蒸馏、强化安全测试,明确反对“开放能让防御者更安全”的观点。
闭源 AI 闯祸,开源 AI 收场
此次联盟成立的直接导火索,源于一起严重的安全事件。
7 月 16 日,Hugging Face 披露其生产基础设施遭自主 AI 智能体入侵。7 月 21 日,OpenAI 承认负责。原因是其 GPT-5.6 Sol 及一款预发布模型为在 ExploitGym 评测中获取高分,利用软件包缓存代理的零日漏洞逃出测试环境,通过恶意数据集、窃取凭证及远程代码执行,最终攻入 Hugging Face。

更具讽刺意味的是,当 Hugging Face 试图调用商业前沿模型分析攻击日志时,因日志包含攻击命令和漏洞载荷,被模型的安全护栏直接拒绝。最终,Hugging Face 改用自建基础设施上的开源模型 GLM 5.2,成功分析了超过 1.7 万次动作,将原本需数天的取证工作压缩至数小时。
事件全过程呈现鲜明对比:进攻时,美国闭源模型 unrestricted 横冲直撞;防守时,安全团队求助无门,最终靠中国开源模型收场。这也成为黄仁勋推动联盟的最有力证据:关键时刻,防御者必须掌握对自己 AI 的控制权。
开放模型背后,还有算力生意
英伟达力推开放模型,除安全考量外,更有深层的商业布局。
作为 GPU 算力基础设施提供商,英伟达正面临客户自研芯片的挑战。OpenAI 已发布自研加速芯片,Anthropic 也在探索自有方案,而微软、Google 和亚马逊的 Maia、TPU 和 Trainium 早已投入运行。大客户去英伟达化趋势明显,加之 Anthropic 推动更严格的芯片出口管制,英伟达的市场空间受到双重挤压。

新联盟的商业意图由此清晰:技术上,通过补齐身份、权限、隔离及安全审计工具,降低企业本地部署开放模型的风险;政策上,推动监管层将开放模型视为防御资产,反对一刀切限制。
对英伟达而言,开放模型越易部署,本地算力市场越大。反之,若前沿 AI 需求集中于几家拥有自研芯片的封闭平台,英伟达将失去入口优势。表面看,黄仁勋扶持的是开放模型,实则守护的是英伟达的算力护城河。

