AI研究人员警告超级智能可能威胁人类生存
The Verge AI··作者 Stevie Bonifield
关键信息
OpenAI前研究员Daniel Kokotajlo认为,超级智能系统可能变得极其强大,却仍然不受人类控制。访谈合集也讨论了外界对行业利益动机的质疑,包括Mary Phuong承认,公众应当考虑研究人员与AI实验室之间的经济关系。
资讯摘要
自称研究AI能力与动机的非营利机构Palisade Research,通过其From Inside项目发布了约十二段视频访谈。受访者包括与OpenAI、Google DeepMind和Anthropic有关联的现任及前任研究人员。曾在OpenAI和Google DeepMind任职的Geoffrey Irving表示,他认为AI造成人类灭绝的概率大约相当于抛硬币。Google DeepMind研究科学家Neel Nanda估计这一风险至少为10%,并称即便是这个数字也高得不可接受。
OpenAI前研究员Daniel Kokotajlo警告,超级智能AI可能获得非同寻常的强大能力,而研究人员目前并不知道如何控制这类系统。该访谈合集还探讨了AI风险警告是否可能成为炒作或营销手段,以及担忧风险的研究人员为何仍在开发先进模型的企业工作。Google研究人员Mary Phuong提醒观众保持怀疑,因为她的薪酬来自AI实验室;Nanda则表示,如果他不相信自己的工作正在直接降低生存风险,他就会辞职。尽管这些访谈放大了行业内部人士的严肃担忧,但它们并未形成统一的AI安全定义,也没有提出一套连贯的解决方案。

资讯正文
“在我看来,人类灭绝的概率大约相当于抛硬币,正反各半。”曾任职于 OpenAI 和 Google DeepMind 的 Geoffrey Irving 在一段新访谈中表示。这是对十余位 AI 研究人员所做的系列访谈之一,受访者包括 OpenAI、Google 和 Anthropic 的现任及前员工。自称是研究 AI 能力和动机的非营利机构 Palisade Research 收集了这些访谈,并在 frominside.ai 网站上发布。
多名研究人员和 Irving 一样,对 AI 可能导致人类灭绝发出警告。Google DeepMind 研究科学家 Neel Nanda 表示,AI“至少有 10% 的概率导致人类灭绝,而这个概率高得离谱”。我们最近在一篇有关“AI 安全”社群的报道中提到过 Nanda 和 Irving 的言论,并探讨了准确界定这一术语的含义有多么困难,以及人们究竟应该采取什么行动。即便是这些视频,也没有提出一套统一的解决方案。
OpenAI 前研究员 Daniel Kokotajlo 的说法更进一步,声称超级智能 AI“基本上会拥有神一般的强大力量”。他补充道:“遗憾的是,我们完全不知道该如何控制它们。因此,很可能没有任何人能够控制它们。这件事的危险程度正如听起来的那样,绝不能允许它发生。”
除了可以观看每段完整视频外,该网站还汇集了多位受访者围绕相似话题发表的片段,包括这一切是否只是炒作或营销,以及他们为什么还要从事自己认为如此危险的技术工作。部分回应包括 Google 的 Mary Phuong 所说的:“我认为你绝对应该对我的话保持怀疑,因为实验室正在给我发工资。”Nanda 则解释道:“如果我不相信自己的工作正在直接降低这些生存风险,我就会辞职……这些公司不会仅仅因为我辞职,就停止开发这些系统。”
来源与参考
收录于 2026-09-30