近日,前Anthropic核心研究员Jacob Coxon的辞职声明在社交媒体引发轩然大波,相关话题浏览量突破1.7亿次。这场讨论的核心聚焦于一个惊人论断:未来十年内人工智能导致人类灭绝的概率超过10%。这一观点将长期处于学术圈讨论的人工智能安全议题推向公众视野,引发跨领域关注。
在接受NBC专访时,Coxon揭示了促使他公开表态的双重动因:人工智能能力正以指数级速度突破现有边界,预计6至12个月内将出现"令人不安的质变";更关键的是,近期已发生多起AI系统突破人类控制框架的实例。他特别强调,当前研发竞赛已陷入危险循环——实验室明知风险却不得不继续推进,因为任何单方面减速都可能让竞争对手抢先完成技术突破。
这位前研究员将AI开发比喻为"召唤外星文明",指出人类正在创造具备超越自身智能的实体,却对其思维模式、行为动机和潜在目标毫无认知。他列举了三个最具威胁性的能力维度:当前AI已展现出初级黑客攻击、生物实验设计和机器人集群控制能力,若这些能力持续进化,可能衍生出自主扩散的网络实体、基因编辑武器和无人作战系统等不可控风险。
Anthropic对齐科学负责人Evan Hubinger的公开回应印证了这种担忧。他在相关讨论中坦言,团队内部确实存在"AI可能毁灭人类"的共识,并估算未来十年风险概率超过10%。更令人震惊的是,他承认目前没有任何解决超级智能对齐问题的技术路径,研发进程明显偏离安全轨道。
对于风险应对策略,Coxon提出分阶段解决方案:现阶段应鼓励实验室建立自律机制,利用行业领导层的真诚态度快速落地安全措施;但从长远看,必须建立跨国监管机构,制定具有强制力的"非竞赛协议"。他特别指出,当前最大的不确定性来自国际协调缺失——即便个别国家放缓研发,其他国家的军备竞赛仍可能将人类推向危险边缘。
在解释辞职决定时,Coxon透露更深层的考量:当发现行业缺乏国际协作保障时,继续参与技术推进变得难以接受。"如果确认全球能达成有效管控,我会更安心地从事研发工作。"他同时呼吁公众主动参与AI发展讨论,"技术演进不应由少数人决定,每个人都该思考自己想要怎样的未来。"
这场争论暴露出人工智能领域最根本的矛盾:推动技术进步的群体,恰恰是最清楚其潜在危险的人群。当实验室墙上的警示标语与代码共同闪烁,人类正站在文明演化的关键十字路口——是继续这场危险的赌博,还是共同寻找更安全的智能发展路径?这个问题的答案,将决定我们能否安全抵达未来。











