大数跨境

AI Safety Benchmark 2.0测试体系及配套测试平台发布

AI Safety Benchmark 2.0测试体系及配套测试平台发布 CAICT人工智能
2026-02-10
515
导读:欢迎大家了解和试用

自2024年以来,中国信息通信研究院(简称“中国信通院”)联合30余家单位依托中国人工智能产业发展联盟(简称“AIIA”)安全治理委员会发起大模型安全基准测试(AI Safety Benchmark)工作,构建人工智能安全测试评估体系,紧跟行业前沿,动态探寻人工智能安全水位。截至目前,累计发起了8期体系化的测试评估工作,共测试模型100余个,引起业界广泛关注。为应对人工智能安全新形式,保障人工智能技术安全赋能千行百业,AIIA安全治理委员会联合产学研各界专家,于2026年2月共同升级发布AI Safety Benchmark 2.0

AI Safety Benchmark 2.0 在原有应用安全测评、对抗安全测评、内容安全测评的基础上,新增前沿安全测评场景安全测评新应用领域安全测评维度,构建起更为全面系统的安全评估体系。

AI Safety Benchmark 2.0 测试体系基于中国信通院自主研发“智钺”大模型安全自动测试平台实施。该平台汇聚了海量高质量测试数据集,支持80余种对抗测试方法,覆盖31类核心测试维度,单条测试响应效率≤2秒,可通过全流程可配置攻击测试与工作流式任务编排能力,实现对大模型安全的标准化、自动化验证。至今,“智钺”平台已服务通信、电力、汽车等行业的多家头部企业,形成了可落地的全链路安全评估能力,为大模型安全合规部署提供坚实可靠的评测与平台支撑。

后续,平台将持续扩大测评数据规模,拓宽服务边界,赋能更多领域的大模型安全合规应用。

当前,中国信通院“智钺”大模型安全自动测试平台已正式接入鲸智社区・大模型公共服务平台(官方网址:https://aihub.caict.ac.cn/),如有试用合作意向,请与文末联系人沟通咨询。

为进一步完善AI Safety Benchmark生态布局,凝聚产业合力共筑人工智能安全防线,中国信通院诚邀产业链上下游伙伴参与AI Safety Benchmark生态。有意向的单位请填写合作伙伴加入申请表,携手构建人工智能安全屏障,共推产业高质量发展。





联系人





黑一鸣 15313308941(同微信)

刘成财 13147290602(同微信)

【声明】内容源于网络
0
0
CAICT人工智能
中国信通院人工智能研究所官方公众号。关注我们,了解中国信通院人工智能工作动态,了解人工智能技术研究、标准制定、评估测试、行业应用、产业发展、监管政策及国际交流等前沿进展。
内容 264
粉丝 2
CAICT人工智能 中国信通院人工智能研究所官方公众号。关注我们,了解中国信通院人工智能工作动态,了解人工智能技术研究、标准制定、评估测试、行业应用、产业发展、监管政策及国际交流等前沿进展。
总阅读27.3k
粉丝2
内容264