前OpenAI与Anthropic研究员雅各布·考克森辞职并警告:超级智能竞赛正将人类文明置于生死赌局

SmartHey9月10日消息,据《商业内幕》报道,曾在 OpenAI 工作、后加入 Anthropic 的人工智能研究员雅各布·考克森(Jacob Coxon)已正式宣布辞职。过去三年间,他先后在两家全球顶尖AI机构从事大模型预训练与对齐相关研究。

考克森发出严肃警示:“当前两大领军机构的做法均缺乏足够审慎。它们正竞相推进具备自我改进能力的超级智能系统——这无异于以全人类的生命为筹码进行豪赌。”

公开履历显示,考克森于2023年加入 OpenAI 技术团队,深度参与 GPT-4o 等关键模型的研发工作;2026年7月转投 Anthropic,担任基础模型研究方向研究员。

他直言不讳地批评两家公司透明度缺失:“开发这些系统的核心研究人员,其实普遍相信——AI 可能在本世纪20年代末之前引发人类灭绝级风险。这不是炒作话术。为维持公众形象,许多高管和资深科学家会在媒体前刻意淡化风险;但私下交流中,我反复听到同一群人表达深切忧虑。”

考克森指出,OpenAI 与 Anthropic 在风险认知上存在差异:“在 OpenAI,相当一部分人尚未真正意识到这场技术竞赛关乎人类文明存续;而在 Anthropic,团队虽清醒认知风险,却陷入‘先发制人’的竞争逻辑——他们认为其他主体不会负责任地推进,因此宁愿承担巨大风险,也要由自己率先实现超级智能。”

这一观点获得 Anthropic 内部人士印证。现任对齐压力测试团队负责人埃文·胡宾格(Evan Hubinger)表示:“雅各布的判断是准确的——我们确实相信,失控的超级智能可能终结人类文明。我个人评估,未来十年内发生此类灾难性事件的概率超过10%。Anthropic 已竭尽全力推进安全研究,但迄今仍未找到可靠的超级智能对齐方案,也无法确认现有技术路径能否最终解决该问题。”