27岁AI研究员因担忧“智能爆炸”导致人类灭绝而从Anthropic辞职

2026/09/10 08:19阅读量 2

前OpenAI及Anthropic核心预训练研究员Jacob Coxon因担忧公司正竞相开发具备自我改进能力的超级智能,可能导致本十年内人类灭绝而辞职。其观点得到Anthropic内部多位安全研究人员的支持,认为失控风险概率超过10%。文章回顾并印证了2015年Tim Urban关于“智能爆炸”的预测,指出随着AI开始参与自身研发,正反馈回路已初步形成,文明正站在灭绝与永生的平衡木上。

事件概述

27岁的英国数学家Jacob Coxon在先后任职于OpenAI和Anthropic从事大模型核心预训练工作后,正式辞职并在社交媒体X上发出警告。他直言,前沿AI从业者中不少人私下相信,若当前追求自我改进超级智能的趋势失控,人类可能在本十年结束前面临灭绝风险。

核心事实与行业反应

  • 个人背景:Coxon拥有剑桥大学数学学位,是GPT-4o及GPT-4.5的核心贡献者,近期加入Anthropic负责预训练工作。
  • 内部支持声音
    • Anthropic对齐负责人公开支持Coxon的判断,认为10年内发生灾难性后果的概率大于10%。
    • 另一位Anthropic安全研究员以个人身份表示赞同,并指出公司内部职位越高的人往往对此类风险越担忧。
    • 刚离职的可扩展监督负责人Joe Benton确认,Coxon对行业现状的描述是准确的。
  • 行业趋势验证
    • OpenAI在发布GPT-5.3 Codex时承认,该模型在创造自身过程中发挥了关键作用,标志着原始反馈回路的出现。
    • AI能力加速突破:包括推翻80年历史的Erdős离散几何猜想、用11天完成费马大定理的形式化证明(预计需人类十年)、以及GPT-6 Astra实现自主操作复杂软件等。

深度分析:从“智能爆炸”到文明抉择

本文引用2015年Tim Urban的文章《The AI Revolution》作为理论框架,分析了当前局势的宿命感:

  1. 智能爆炸(Intelligence Explosion)正在兑现:当AI达到顶级研究员水平后,将致力于制造更聪明的下一代AI,形成“更强智能->更强研发能力->更强智能”的正反馈回路。虽然尚未达到完全递归自我改进的阶段,但逻辑链的最初环节已经显现。
  2. 竞争驱动的不可逆性:更聪明的AI带来更大经济价值,吸引资本购买更多GPU,进而训练更强AI。在公司与国家间的激烈竞争中,没有任何个体或群体能掌握航向,整个文明如同一条流速越来越快的河流。
  3. 文明的终极平衡木:超级智能的出现将人类文明推向两个极端——
    • 灭绝:因失控导致文明加速毁灭,这是物种历史上常见的“吸引子状态”。
    • 永生(Species Immortality):通过根除疾病、衰老和死亡,使生命摆脱自然限制。这是地球生命从未抵达过的彼岸。

结论

AI的发展已超越普通技术产品范畴,成为关乎物种存续的赌局。尽管存在巨大的灭绝风险,但若能成功跨越平衡木,AI有望帮助人类实现物种永生。目前,行业正处于这一高风险高回报的关键转折点上。

准备好启动您的定制项目了吗?

现在咨询,即可获得免费的业务梳理与技术架构建议方案。