谷歌 DeepMind 安全研究员离职:警告 AI 五年内造成重大灾难的概率“高得惊人”

# 谷歌 DeepMind 安全研究员离职:警告 AI 五年内造成重大灾难的概率“高得惊人”

近日,谷歌 DeepMind 一位资深安全研究员宣布离职,并在离职声明中发出严厉警告:人工智能在未来五年内引发全球性重大灾难的概率“高得惊人”。这一表态迅速引发行业与学界的广泛关注,再次将 AI 安全与对齐问题推至舆论中心。

## 风险时间线大幅缩短

该研究员并未透露具体量化模型,但其核心论断——五年窗口期——与以往“数十年后潜在风险”的共识形成鲜明对比。他指出,当前大语言模型与多模态系统的能力正以指数级增长,而相应的安全机制远未跟上。具体而言,当 AI 系统在代码生成、生物设计、自主决策等领域达到“临界能力”后,恶意使用或误对齐导致的灾难性后果可能瞬间爆发,例如自主开发生化武器、操纵关键基础设施,或造成不可逆转的经济动荡。

## 从专家警告到体制性反思

这位研究员并非孤例。在此之前,Geoffrey Hinton、Yoshua Bengio 等 AI 先驱已分别从不同角度表达了对失控风险的深切担忧。然而,与前人主要聚焦“长期主义”不同,本次离职警告更强调**短期内的系统性脆弱性**:许多现有安全测试仅评估模型在“正常”环境下的表现,却未模拟恶意对抗输入、越狱攻击或并发故障场景。该研究员认为,五年时间窗口的紧迫性源于技术商业化竞赛——各公司为争夺市场,大幅压缩部署前的安全验证周期,将“先发布后修复”的策略用在不可预测的 AI 系统上,无异于并线驾驶。

## 行业与监管的应对之策

面对此类警告,学界呼吁建立类似核武器领域的“安全审查”机制,包括强制性红队测试、模型权重访问限制以及跨国治理框架。DeepMind 母公司 Alphabet 虽已设立独立的 AI 责任委员会,但在实际执行中面临商业优先与安全优先的深层矛盾。该研究员离职本身也折射出安全研究者在体制内推动改革时遇到的阻力——当安全建议与业务增长目标冲突时,后者往往占据上风。

可以预见,随着 AI 能力持续跃升,类似的声音只会更加频繁和尖锐。五年内能否构建足够坚固的“防护网”,不仅取决于技术突破,更取决于整个产业是否愿意将安全从“可选项”提升为“前提条件”。否则,一旦预测成真,我们或许没有机会再讨论“下一次该怎么办”。

相关文章