
前沿大模型能力跃升、通用智能体迈向自主决策和执行、开源生态加速扩张——AI的能力边界与风险边界正在同步扩展。与此同时,一些不容回避的问题浮出水面:我们对前沿AI的安全风险认识是否充分?当AI从被动回答走向主动执行,现有的安全治理体系是否还跟得上?AI风险溢出国界,如何找到一条协同治理之路?
7月19日9:00,由安远AI主办的WAIC 2026“前沿AI与智能体安全论坛”将在上海世博桐森酒店三层桐森厅1+2准时开启。作为本届大会治理板块的核心专业论坛之一,本论坛紧扣国家“十五五”规划对AI安全的战略部署,将围绕前沿AI风险监测与预警、智能体安全与应急管理、全球AI安全治理三大主题展开深度对话。论坛集结二十余位重量级嘉宾,从图灵奖得主,到头部企业一线实践者,再到中外政策代表。论坛还将发布五项研究成果,力图为前沿AI与智能体安全的技术监测、风险预警、应急响应等领域提供专业的技术支撑、实证依据与治理参考。
主题一:前沿AI风险监测——从科学认知到工具落地
当前,前沿大模型迭代加速,AI for Science、具身智能等前沿方向持续涌现,“看不清风险”成为政策制定与产业实践的共同困境。本单元汇聚国内外人工智能安全研究的顶尖学者,依托科学共识与评测积累,围绕下一代AI能力评测与风险预警工具展开深度研讨。图灵奖得主Yoshua Bengio将解读由其领衔、多国学者共同撰写的《2026年国际人工智能安全报告》的最新发现。上海人工智能实验室主任、首席科学家周伯文将发表主旨演讲。圆桌嘉宾来自加州大学伯克利分校、西湖大学等顶尖学府,以及前美国白宫科学和技术政策办公室,将就“前沿人工智能安全的科学认知和边界”议题展开深入讨论。
本单元将发布两项成果:《前沿AI风险管理框架》2.0版本与“前沿AI风险监测平台”2.0版本。
《前沿AI风险管理框架》由上海人工智能实验室和安远AI联合推出。1.0版是国内首个聚焦前沿风险的风险管理框架,为通用AI模型研发者提供了一套全流程的风险管理指南,帮助其主动识别、评估、缓解和治理危及公共安全与国家安全的严重风险;2.0版在此基础上通过深化失控风险相关内容、迭代红线风险场景、更新开发者风险分析实操指南,并增强与国内外领先风险管理指南的互操作性,实现了全面的迭代升级。
“前沿AI风险监测平台”2.0版本已覆盖全球16家领先开发商的80余个前沿大模型,围绕网络攻击、生物风险、化学风险、有害操纵与失控五大风险领域开展持续追踪;本次将发布风险指数2.0升级、2026Q2风险监测报告、前沿AI风险测评基准数据库,以及1项生态合作成果——由复旦大学系统软件与安全实验室、上海人工智能实验室和安远AI合作的大模型自主渗透能力评估。
主题二:智能体时代——全生命周期安全治理与风险干预
随着AI智能体展现出自我迭代、跨环境交互与目标涌现能力,“管不住的风险”从理论担忧走向现实挑战。本单元聚焦智能体从研发、部署到运行的全生命周期干预机制。涵盖“前沿AI安全的技术实践与产业治理”和“智能体失控风险与网络空间应急管理”两个议题。
前者,来自中国信息通信研究院、前沿模型论坛、Hugging Face、以及前Google DeepMind的专家将分享产业前沿经验;后者,来自浙江大学、阿里巴巴、国际人工智能安全报告首席作者,以及前OpenAI与Anthropic的专家将共同探讨应急管理机制。
本单元将发布两项成果:《通用AI智能体L1-L5分级安全框架白皮书》与《前沿AI风险与应急响应研究报告(征求意见稿)》。
其中,《通用AI智能体L1-L5分级安全框架白皮书》(安远AI联合上海人工智能实验室、清华大学智能产业研究院、华为)以“自主性”作为能力分级主轴,将通用型智能体分为五级(L1–L5),分析各等级可能的风险演进路径和高自主性等级的新兴风险,并提出相应的安全防护和综合治理措施建议,试图为智能体开发者、使用者和研究与评测者提供一套可参考、可对标的分级安全治理范式。
《前沿AI风险与应急响应研究报告(征求意见稿)》(安远AI联合中国新一代人工智能发展战略研究院、清华大学人工智能国际治理研究院)则是国内首份聚焦前沿AI风险及其应急体系建设的研究,报告直面前沿AI对网络、公共卫生、金融等安全攸关领域突发事件的风险重塑作用,识别治理痛点,呼吁各界共同探讨如何构建适配前沿AI风险的应急响应体系。
主题三:前沿AI风险治理与全球视角
前沿AI风险的跨国性使其展现出前所未有的治理难度,也决定了其治理必须建立在国际对话与合作基础上。依托中国实践,通过全球对话促进治理协同与标准对接,共同探讨如何将一线的技术监测、风险预警与应急响应实践,转化为全球互认的技术标准与多边共识。
本单元汇聚来自联合国、美国NIST、新加坡IMDA、牛津大学等机构的政策代表,与中国顶尖智库学者共同探讨标准互认与规则对接路径。
本单元还将发布《中国人工智能安全全景报告(2026)》(State of AI Safety in China 2026)。这一系列英文年度报告自2023年起持续追踪中国AI安全治理进展,2025版已被人民日报、Nature、TIME、Wired、Bloomberg等广泛引用,成为全球了解中国AI安全治理进展的一手窗口。

