27岁AI研究员因担忧“智能爆炸”导致人类灭绝而从Anthropic辞职
2026/09/10 08:19阅读量 2
前OpenAI及Anthropic核心预训练研究员Jacob Coxon因担忧公司正竞相开发具备自我改进能力的超级智能,可能导致本十年内人类灭绝而辞职。其观点得到Anthropic内部多位安全研究人员的支持,认为失控风险概率超过10%。文章回顾并印证了2015年Tim Urban关于“智能爆炸”的预测,指出随着AI开始参与自身研发,正反馈回路已初步形成,文明正站在灭绝与永生的平衡木上。
事件概述
27岁的英国数学家Jacob Coxon在先后任职于OpenAI和Anthropic从事大模型核心预训练工作后,正式辞职并在社交媒体X上发出警告。他直言,前沿AI从业者中不少人私下相信,若当前追求自我改进超级智能的趋势失控,人类可能在本十年结束前面临灭绝风险。
核心事实与行业反应
- 个人背景:Coxon拥有剑桥大学数学学位,是GPT-4o及GPT-4.5的核心贡献者,近期加入Anthropic负责预训练工作。
- 内部支持声音:
- Anthropic对齐负责人公开支持Coxon的判断,认为10年内发生灾难性后果的概率大于10%。
- 另一位Anthropic安全研究员以个人身份表示赞同,并指出公司内部职位越高的人往往对此类风险越担忧。
- 刚离职的可扩展监督负责人Joe Benton确认,Coxon对行业现状的描述是准确的。
- 行业趋势验证:
- OpenAI在发布GPT-5.3 Codex时承认,该模型在创造自身过程中发挥了关键作用,标志着原始反馈回路的出现。
- AI能力加速突破:包括推翻80年历史的Erdős离散几何猜想、用11天完成费马大定理的形式化证明(预计需人类十年)、以及GPT-6 Astra实现自主操作复杂软件等。
深度分析:从“智能爆炸”到文明抉择
本文引用2015年Tim Urban的文章《The AI Revolution》作为理论框架,分析了当前局势的宿命感:
- 智能爆炸(Intelligence Explosion)正在兑现:当AI达到顶级研究员水平后,将致力于制造更聪明的下一代AI,形成“更强智能->更强研发能力->更强智能”的正反馈回路。虽然尚未达到完全递归自我改进的阶段,但逻辑链的最初环节已经显现。
- 竞争驱动的不可逆性:更聪明的AI带来更大经济价值,吸引资本购买更多GPU,进而训练更强AI。在公司与国家间的激烈竞争中,没有任何个体或群体能掌握航向,整个文明如同一条流速越来越快的河流。
- 文明的终极平衡木:超级智能的出现将人类文明推向两个极端——
- 灭绝:因失控导致文明加速毁灭,这是物种历史上常见的“吸引子状态”。
- 永生(Species Immortality):通过根除疾病、衰老和死亡,使生命摆脱自然限制。这是地球生命从未抵达过的彼岸。
结论
AI的发展已超越普通技术产品范畴,成为关乎物种存续的赌局。尽管存在巨大的灭绝风险,但若能成功跨越平衡木,AI有望帮助人类实现物种永生。目前,行业正处于这一高风险高回报的关键转折点上。
