一句话结论
非营利组织 Palisade Research 发布十余场访谈,多位现任及前员工称人类灭绝风险约一半概率,需高度警惕超强 AI 带来的生存威胁。
关键要点
- Palisade Research 在 frominside.ai 上线十余段研究者访谈视频,涵盖 OpenAI、Google DeepMind、Anthropic 等机构。
- 前 OpenAI 与 Google DeepMind 员工 Geoffrey Irving 表示,“我认为人类灭绝的可能性就像抛硬币一样,各占一半”。
- Google DeepMind 研究科学家 Neel Nanda 指出,“至少有 10% 的可能性导致人类……”(原文未完,语境为灭绝或重大危机)。
- 访谈团队由自称非营利、专注研究 AI 能力与动机的组织 Palisade Research 策划并公开。
- 多位受访者共同表达了对超强 AI(superintelligence)可能引发人类灭绝的严重关切,并强调该风险“听起来有多危险,实际就有多危险”。
背景与事实
2024 年,非营利组织 Palisade Research 发起一项公开访谈计划,旨在记录并传播 AI 领域核心研究者对超强人工智能潜在风险的评估。该组织在 frominside.ai 平台上上线了十余段访谈视频,受访对象包括当前和曾经在 OpenAI、Google DeepMind、Anthropic 等头部机构工作的研究人员。这些访谈的核心主题围绕“超强人工智能是否足以构成人类生存级威胁”展开。
前 OpenAI 与 Google DeepMind 员工 Geoffrey Irving 在访谈中直言:“我认为人类灭绝的可能性就像抛硬币一样,各占一半。”这一表述被多家媒体引述,成为该系列访谈中最具传播力的观点之一。Google DeepMind 的研究科学家 Neel Nanda 也表达了类似但更为保守的判断,他提到“至少有 10% 的可能性导致人类……”,虽原句未完整披露,但上下文语境明确指向人类灭绝或不可逆的重大灾难。多位受访者反复强调,超强 AI 的危险性“听起来有多可怕,实际就有多真实”,呼吁公众与政策制定者正视这一风险。
从组织背景看,Palisade Research 自我定位为专注于研究人工智能能力与动机的非营利机构,其发布渠道 frominside.ai 是专为该系列访谈搭建的专题网站。访谈视频已面向公众开放,内容包括技术路径分析、风险概率估计、缓解策略探讨等,试图在科学界内部形成更透明的风险对话空间。
影响分析
对中文开发者与从业者而言,这一系列访谈的公开传播具有双重影响。一方面,它强化了行业内部对超强 AI 安全问题的共识基础——即顶级研究者已不再将灭绝风险视为理论假想,而是赋予具体概率区间(如 10% 至 50%),这将促使国内 AI 实验室、高校及监管机构在研发路线上更加重视对齐(alignment)、可解释性与可控性技术。另一方面,公开访谈也可能加剧公众对 AI 发展的焦虑情绪,影响政策资源分配与社会接受度。分析判断认为,中文社区若忽视这一国际信号,可能在风险治理框架建设上落后于欧美同行,尤其是在国家级 AI 安全标准制定与跨机构协作机制方面。
适用边界
上述风险概率评估基于特定研究者个人的主观判断,并非同行评审的科学结论,不同实验室、不同技术路线(如 LLM 是否足以达成超强智能)会得出差异极大的结果。因此,“50% 灭绝概率”这一数字不可直接套用于所有 AI 系统或应用场景;对于仅使用现有大模型工具链的开发者,其日常工程风险远未触及灭绝级别。此外,访谈中部分引述不完整(如 Neel Nanda 的原话截断),需结合完整视频或后续官方转录才能准确理解其具体指代对象与限定条件。
孤本观察
编辑观察指出:当一位前 OpenAI 员工公开使用“抛硬币”这样极端通俗化的比喻来描述灭绝风险时,说明该风险叙事已从学术圈层突破至公共传播领域;而 Palisade Research 选择以视频访谈而非论文形式发布,暗示其目标受众已包含非技术背景的决策者与公众,这本身即是 AI 风险治理话语体系演进的一个标志性节点。

常见问题
Geoffrey Irving 认为人类灭绝的可能性是多少?
像抛硬币一样,各占一半(约50%)
Neel Nanda 估计导致人类重大危机的最低概率是多少?
至少有 10%
该系列访谈涵盖哪些机构的研究人员?
OpenAI、Google DeepMind、Anthropic 等
“50% 灭绝概率”这一数字适用于所有 AI 应用场景吗?
不适用,该数字基于个人主观判断,不可直接套用于所有系统,日常工具链风险远未触及灭绝级别。
来源:The Verge AI