平克呼吁以务实安全取代末日论

The Decoder··作者 Manuel Uth

关键信息

平克认为回形针最大化器情景依赖于两个可疑假设:智能会自然产生支配欲,以及人工智能会以病态的单一执着追求某个目标。曾邀请平克辩论的斯科特·亚历山大估计人工智能导致人类灭绝的概率为20%,并支持加强安全研究以及通过国际协议放缓发展。

资讯摘要

哈佛心理学家史蒂文·平克认为,人工智能消灭人类的担忧被夸大了。他在 Quillette 上发表公开信,回应精神科医生兼有影响力的科技博主斯科特·亚历山大;后者曾邀请他就人工智能的生存风险进行公开辩论。平克拒绝了这场辩论,并称此类活动只是“观众运动”。他的批评重点是回形针最大化器等情景,在这些情景中,人工智能为了追求看似无害的目标而毁灭人类。

平克认为,这些情景把智能与支配欲混为一谈,也假设人工智能会以极端且不理性的执着追求单一目标。与此同时,他承认自己低估了大型语言模型的能力增长,也没有预料到人工智能公司会如此鲁莽地发布产品。他认为生物恐怖主义、网络攻击和缺乏约束的人工智能代理是更值得认真对待的危险,并主张通过独立监督、法律责任和人类控制来应对,而不是依赖末日式言论。亚历山大的立场更加悲观:他认为人工智能导致人类灭绝的概率为20%,并支持加强安全研究以及通过国际协议放缓发展。

平克呼吁以务实安全取代末日论

资讯正文

哈佛大学心理学家 Steven Pinker 认为,对于人工智能将人类灭绝的担忧被夸大了。他在 Quillette 发表的一封公开信中阐述了自己的观点。这封信写给精神科医生、颇具影响力的科技博主 Scott Alexander,后者此前曾向他发起公开辩论的挑战,讨论人工智能带来的生存风险。Pinker 拒绝了邀请,称这类活动不过是“观赏性比赛”。

Pinker 认为,回形针最大化器之类的末日情景——在这一设想中,人工智能为了制造更多回形针而牺牲全人类——混淆了智能与支配欲。这些情景还假定,人工智能系统会疯狂执着于某个单一目标。

Pinker 过去一直对人工智能持乐观态度,但他现在承认,自己低估了大型语言模型将会变得多么强大。他也没有预料到人工智能公司会如此鲁莽地发布产品。颇具讽刺意味的是,这股竞相发布产品的浪潮,正是由来自同一个不断警告这些风险的群体的人所引领。

Pinker 真正严肃看待的危险包括生物恐怖主义、网络攻击,以及不受约束的人工智能智能体。他写道,末日论调对解决这些问题毫无帮助。真正有效的是建立在独立监督、责任追究和人类控制基础之上的审慎安全工程。

Alexander 已于今年 6 月在自己的博客上阐述了立场。他认为人工智能导致人类灭绝的概率为 20%,并希望加强安全研究,同时通过国际协议减缓人工智能的发展速度。

来源与参考

  1. 原始链接
  2. Harvard psychologist calls for sober AI safety engineering over doomsday rhetoric

收录于 2026-09-29