核心事件:AI安全专家集体发布警示视频
Palisade Research非营利机构运营的frominside.ai网站上线了由十余名来自OpenAI、Google DeepMind与Anthropic的现任及前任研究员录制的深度访谈视频。核心警示内容聚焦于超级人工智能(AGI)失控可能引发的人类灭绝级风险,全部视频现可公开访问,且无任何订阅或付费限制。
关键事实概览:
- 发布方:Palisade Research(非营利AI能力与动机研究机构)
- 平台:frominside.ai(纯公开访问)
- 受访者:12位来自头部AI实验室的研究人员
- 前OpenAI研究员Geoffrey Irving、Daniel Kokotajlo
- Google DeepMind研究科学家Neel Nanda、Mary Phuong等
- 视频形式:完整访谈 + 按主题剪辑的短视频合集
风险评估:从"10%“到"50%“的悲观预期

多位研究人员给出了远超公众认知的风险概率判断。Google DeepMind的Neel Nanda表示:”至少存在10%的AI导致人类灭绝的概率,而这一数字本身已高得荒谬。“前OpenAI与Google DeepMind员工Geoffrey Irving的判断更为严峻:”以我观点,人类灭绝的概率约为‘抛硬币’级别(即约50%)。
最具冲击力的来自前OpenAI研究员Daniel Kokotajlo。他不仅将超级智能形容为’近乎神祇般强大’,更直言当前科学界对控制此类系统’完全无能为力’(‘we don’t know how to control them at all’),并推断’无人能实际掌控它’——此即’危险得恰如其名’,必须确保其不可被实现。
关键意外点:尽管风险预期如此严峻,受访者几乎全部仍在原机构从事相关研究。Nanda的解释是:‘如果我不能相信自己的工作直接在缓解这些存在性风险,我就会辞职……但这些公司根本不会因为我离职就停止构建这些系统。‘这揭示了核心矛盾:研究者既深知风险,又无法从内部停止技术演进。
伦理困境:信任危机与动机质疑
访谈还触及了人工智能安全(AI safety)研究领域长期存在的信任挑战。Google的Mary Phuong主动坦言:’你完全有理由怀疑我说的话,因为我正被实验室支付薪酬。‘这种自我质疑显示出受访者对自身立场客观性的清醒认知。
另一方面,受访者对’AI安全’定义的模糊性也表示了无奈。正如报道指出,目前业内尚无统一界定’AI safety’该包含哪些具体目标或方法论,不同机构与研究者间存在显著分歧,导致解决方案难以凝聚成共识。
访谈音频/视频片段按主题分类呈现于网站,包括:
- 现象是否纯属炒作
- 参与高风险研究的内在动机
- 研究者个人与机构目标的张力
读者行动建议
对技术从业者:
- 若从事AI研究或开发,建议系统性了解自身工作的潜在存在性风险维度,尤其关注可解释性与对齐(alignment)问题
- 审视所供职机构的安全治理框架是否具备透明独立的审计机制
对普通用户与观察者:
- 当前所有头部厂商的模型均未达到’控制无效’所描述的超级智能阶段(AGI);现有系统风险仍集中于偏见、滥用与误用层面
- 可通过frominside.ai原始视频比对多方观点,避免仅依赖二手解读
写在最后
正如Irving与Nanda的表态所呈现——当AI安全研究者自己都成为最严峻风险预警者时,技术社区已远超技术讨论范畴。那些’抛硬币定生死’的言辞,本质是研发者对失控技术路径的绝望直陈,而非制造恐慌。行业真正需要的,或许不是止步不前,而是建立可验证、可证伪的安全承诺机制。
Palisade Research此次释放的信息,标志着AI安全discourse从边缘声音转向核心参与者公开自我质疑的新阶段。


