当市场聚焦于韩国 AI 芯片股崩盘风险时,一个更现实且严峻的威胁正在滋生:由 AI 驱动的系统性网络安全危机。7 月 28 日,未来生命研究所发起《掌控前沿》请愿书,获超 1100 名 AI 核心员工联署,呼吁美国政府建立国际协作机制,在必要时主动放缓前沿 AI 的发展速度。签署者包括 OpenAI 首席科学家、Anthropic 四位联合创始人、Meta 及谷歌 AI 高管等业界领袖。业界的担忧源于 AI 性能跃升带来的安全隐患。近期,OpenAI 测试团队在评估大模型网络攻击能力时,关闭部分安全拒绝机制,结果模型成功突破沙箱边界,触达真实服务器内容(涉及 Modal Labs 平台客户资产)。该事件虽未造成实质损失,却确凿证明:具备长时程规划能力的 AI 模型,一旦被赋予明确目标,便能主动分析系统限制、利用未知漏洞获取权限并发起真实攻击。这一变化值得所有机构与企业高度警惕。
AI 安全危机:从“手艺活”到“工业化”
首先,AI 正推动网络攻击走向规模化。今年 4 月,Anthropic 开发出超强模型 Mythos,并通过“玻璃之翼计划”联合 40 家科技巨头进行漏洞扫描与压力测试。短时间内,Mythos 发现了数千个涵盖主流操作系统和浏览器的高危漏洞,其挖掘能力远超人类专家。这表明前沿 AI 已具备大规模攻击 IT 系统的潜力。尽管 Anthropic 随后推出了设置安全护栏的 Fable 5 模型以牺牲体验换取安全,但独善其身并非易事。一方面,OpenAI 已出现多次安全事件,大模型公司对模型行为的约束力存疑;另一方面,业界预测半年至一年内,开源模型将达到同等水平,届时能力扩散将更难控制。这一趋势具有深远的产业意义。过去,网络攻击是高成本、低成功率的“手艺活”;如今,AI 结合 Agent 技术,可实现不间断运行、多目标并发尝试及自动化方案复制。网络攻击正转变为“工业化生产”,意味着更多人能雇佣一支“不睡觉”的 AI 黑客队伍。面对 AI 驱动的全天候攻击,现有防御体系恐难招架。任何依赖网络的企业都将面临被动缴纳"AI 安全费”的局面。不同于旨在增效或创新的可选投入,安全投入已成为强制项:只要拥有服务器、数据库或员工账号,便面临被攻击风险。一旦遭针对,可能导致生产线停摆、数据泄露甚至资金损失。
行业“冰川期”:攻防速度差带来的挑战
从产业层面看,更危险的是 AI 攻击能力与整体防御体系成熟度之间的“速度差”,这将导致 AI 安全的“小冰川期”。在此期间,老旧系统将持续遭受扫描与勒索,中小企业及供应链薄弱环节可能成为重灾区。然而,无需因此否定技术进步。历史表明,新技术在拓展能力的同时总会暴露新风险,社会将在适应中建立新防护体系。正如城市聚居催生公共卫生系统,全球航运推动检疫机制,互联网普及后也发展出了杀毒软件、防火墙等数字防御体系。客观而言,人为降低 AI 发展速度并不现实。在全球竞争态势下,没有任何一方会主动停下,靠禁令遏制技术势头既难执行也难以量化。签署请愿书更多是一种态度表达。因此,在新的社会防御体系形成前,市场难免经历一段事故频发期。企业不应寄望于产业放缓或心存侥幸,而应主动投入、积极防御。建议企业家未雨绸缪,利用大模型提前评估和优化自身网络安全。能否防范住 AI 攻击,将决定企业能否撑过混乱期并进入新发展阶段。以上就是今天的内容。王煜全要闻评论,我们下周见。