ITBear旗下自媒体矩阵:

Anthropic对齐负责人称未来十年内AI致全人类灭亡的概率超过10%,且尚无解决方案

   时间:2026-09-09 11:11:12 来源:鞭牛士编辑:快讯 IP:北京 发表评论无障碍通道
 

9 月 9 日,Anthropic 对齐压力测试团队负责人 Evan Hubinger(@EvanHub)在回复前 OpenAI 和 Anthropic 预训练研究员 Jacob Coxon 的辞职推文时确认,AI 可能会消灭所有人类所有人类,他个人认为未来十年内这种可能性超过 10%。

Evan Hubinger 表示,他相信 Anthropic 正在尽最大努力,但目前还没有解决超级智能对齐问题的计划,也没有明确走上解决该问题的正轨。

此前,Jacob Coxon(@hilbertspaess)于 9 月 9 日宣布从 Anthropic 辞职,并连续发布七条推文警告 AI 发展风险。Coxon 表示,过去三年他先后在 OpenAI 和 Anthropic 从事预训练研究,两家公司都表现得极不负责任,正不顾一切地奔向“自我迭代的超级智能”,拿人类的生命赌博。

Coxon 警告,不要低估这项技术的力量,这些系统很快就会成为超人系统,可以黑入任何东西,一夜之间彻底改变任何领域,并获得真正的权力和资源。他强调,建造 AI 的人真诚地相信 AI 可能在本十年末杀死所有人,这不是营销噱头,许多高管和高级研究员在媒体上会措辞谨慎以显得明智,但私下都表达恐惧,没有其他人类活动构成这种程度的危险。

关于两家公司的情况,Coxon 指出,在 OpenAI,许多人没有深刻理解文明层面的利害关系;在 Anthropic,利害关系得到了充分理解,但他们被锁在一场争先到达终点的竞赛中,相信没有其他人会负责任地行动,所以必须自己做,尽管有风险。他认为,接受这场竞赛并进入“终局”是一种傲慢的赌博,不应该从一家私营公司的内部沟通中发起。

Coxon 表示对协调的潜力持乐观态度,像 Hugging Face 攻击这样的警告信号使得美国实验室之间的步调协议更加可行,但他不认为目前正走在防止全球竞赛的轨道上,这可能需要代价高昂的行动,比如暂时禁止提高模型能力。他同时呼吁实验室研究员考虑未来几年的实际情况,不要因为“反正都在发生“而埋头苦干,而应趁现在呼吁不同的条件。

 
 
更多>同类资讯
全站最新
热门内容
网站首页  |  关于我们  |  联系方式  |  版权声明  |  争议稿件处理  |  English Version