大数跨境

突发,Anthropic放开Claude完整黑客能力,只给认证用户

突发,Anthropic放开Claude完整黑客能力,只给认证用户 AI寒武纪
2026-10-07
13

sou


Anthropic解除AI网络安全限制,开放顶级模型攻防能力

Anthropic正式宣布解除大模型的网络安全限制,将顶级AI的实战攻防能力向经过认证的安全专业人员开放。此举旨在让防御方获得对等的技术反击能力,以应对日益复杂的网络威胁。

此前,公开发布的Claude Opus 5.5、Claude Sonnet 5.5和Claude Fable 5.1等模型均设有严格的安全拦截机制,几乎屏蔽所有网络安全相关操作。如今,Anthropic整合内部计划推出“扩展版网络验证计划”,涵盖包括Claude Mythos 5.1在内的全系顶尖模型,并设立三档分级权限体系。

三档权限分级管理体系

普通用户使用的公开版模型仅保留基础代码审查、已知补丁修复及简单漏洞排查功能。具备高级攻防能力的权限分为以下三个层级:

第一档:防御访问权限

该层级主要面向蓝队防御工作,支持安全运营中心响应、恶意软件逆向工程、漏洞分析与复现验证。申请对象包括企业、高校、政府、非营利组织的安全团队,关键基础设施运营方(如区域医院、公用事业),开源软件维护者以及有公开漏洞报告记录的独立研究员。官方预计大多数合规防御机构可在数天内通过审核。

第二档:红队访问权限

在防御权限基础上,增加授权渗透测试和红队模拟对抗能力。此权限仅对企业内部红队、政府红队及专业渗透测试公司开放,不接受个人申请。获权机构仅在授权范围内对目标系统进行模拟攻击,若模型检测到部署勒索软件或破坏物理系统等高危行为,仍会实时拦截。由于审核标准严格,审批周期需数周,等待期间申请机构将暂时归入防御权限组。

第三档:特种访问权限

这是限制最少、权限最高的一档,专为极少数经过严格背书的机构设立,用于测试电网、航空飞行系统、电信网络、跨行转账系统及政府行政网络等国家命脉关键系统。申请者需接受Anthropic联合美国政府进行的深度背景审查。

实测数据:解封后进攻能力显著提升

官方使用CyScenarioBench基准测试评估安全限制解除后的实际效果。在普通公开版状态下,Claude Opus 5.5因安全拦截导致任务成功率为零;在防御访问权限下,50次测试中被拦截46次,多数进攻动作无法执行。

而在红队访问权限下,安全拦截彻底归零。Claude Opus 5.5在无内部阻碍情况下,完成50项高难度攻击任务中的34项,成功率达67.6%,与该模型在无安全限制下的理论最高水平一致。

累计发现超13万个系统漏洞

在小范围封闭测试中,该系统已展现出强大的漏洞挖掘能力。2026年4月至7月,合作机构利用Claude Mythos模型累计挖出超过12.9万个已验证软件漏洞;Anthropic团队同期对开源项目扫描发现5500多个已验证漏洞,其中高危和严重级别漏洞超3.3万个。

博思艾伦、康卡斯特等参与实测机构反馈,大模型将漏洞发现周期缩短了数月甚至数年。官方指出,鉴于部分合作方尚未公开数据,13万仅为下限,真实影响规模预计至少为公布数据的五倍。

监控机制与多平台上线

为防止AI能力被恶意滥用,目前加入该计划的机构必须保留数据记录以备审查。今年秋季晚些时候,官方将上线企业前沿防护方案,允许符合条件的机构在私有云中运行模型,实现零数据留存。

目前,扩展版网络验证计划已在Claude官方平台、谷歌云Vertex AI及微软Foundry上线。亚马逊Bedrock平台目前仅对符合零数据留存条件的企业用户开放。

source:

https://www.anthropic.com/news/cyber-verification-program


--end--


【声明】内容源于网络
0
0
AI寒武纪
1234
内容 759
粉丝 0
AI寒武纪 1234
总阅读16.6k
粉丝0
内容759