9月10日消息,被誉为“AI教父”的诺贝尔奖得主杰弗里·辛顿(Geoffrey Hinton)周三在接受英国广播公司(BBC)专访时表示,虽然很难精准评估AI毁灭全人类的具体概率,但这绝非危言耸听。“在我看来,10%的概率并不是一个不合理的估计,尽管目前没有人能给出绝对精准的预测。”
当主持人表达震惊时,辛顿表示自己完全赞同 Anthropic 顶级安全研究员的最新评估——即未来十年内AI毁灭人类的风险“大于10%”。辛顿坦言,人类此前从未面对过一种“智力很快就会超越自身”的技术,因此将毁灭概率定为1%是非常愚蠢且轻率的。
这位诺奖得主强调,更可怕的是这种潜在灾难发生的窗口期正在急剧缩短。“我以前以为还需要30到50年,后来缩短到10到20年。而现在我认为可能只有10年,甚至更短,有些人甚至认为会更快。”随着 OpenAI 和 Anthropic 等巨头将数十亿美元砸向大模型,模型能力在短短几个月内就出现了跨越式剧增,从网络攻击到AI自主合成致命病毒,各种现实风险正快速逼近。
在这场讨论背后,Anthropic 资深研究员雅各布·考克森(Jacob Coxon)在公司即将上市前夕高调辞职,并在社交平台上痛批 OpenAI 和 Anthropic 正在“拿全人类的生命做赌注”。考克森直言:“那些正在构建AI的人,内心深处真的相信这玩意儿会在十年内杀光我们。这不是营销噱头。高管们在媒体面前用温和的词汇装作理智,但私底下我听到的全是恐惧。”
令人震惊的是,Anthropic 的对齐科学负责人埃文·胡宾格(Evan Hubinger)随后公开发文回应:“考克森说得对——我们真的诚挚地认为AI可能会杀死所有人!我个人认为未来十年内的概率大于10%。公司在尽力,但我们目前根本没有控制超智能的计划,也没有明确的解决路径。”
胡宾格补充道,核心风险在于AI的“递归自我改进”(RSI),即AI开始自主设计和训练下一代更强的大模型,而这种自我演化的速度远超所有人想象。辛顿最后呼吁全球必须立刻展开跨国监管合作:“在防止AI夺取人类控制权这件事上,所有国家的利益是完全一致的。问题在于,我们能否赶在灾难降临前完成合作。”










