Anthropic研究员辞职背后的理性主义亚文化:AI安全治理的制度性缺陷

2026/09/18 13:12阅读量 3

Anthropic研究员Jacob Coxon在股权兑现前辞职并警告AI可能毁灭人类,其言论迅速引发舆论风暴及政界关注。文章指出,Coxon所属的“理性主义”亚文化已渗透进AI实验室、安全机构及政策网络,其成员通过封闭的社交圈和意识形态控制影响行业走向。该群体内部存在精神操控、极端派系分裂及与反民主政治势力合流等问题,暴露出当前AI安全治理缺乏独立监督和利益冲突回避机制的制度性风险。

事件概述

2026年9月8日,Anthropic研究员Jacob Coxon在股权完全兑现前两个月辞职,并发布公开信警告制造AI的人真诚相信该技术可能在本世纪末消灭全人类。该帖文24小时内浏览量破亿,同事Evan Hubinger证实内部确实存在此类担忧,个人评估十年内发生概率高于10%。随后二十多位美国国会议员呼吁采取行动,而埃隆·马斯克则斥之为认知战心理战(psy-op)。这一事件将公众视线引向一个持续25年的互联网亚文化——“理性主义”(Rationalism),其成员已深度嵌入硅谷科技巨头、AI安全研究机构及政策制定网络。

核心信息

1. 理性主义亚文化的起源与扩张

  • 起源:始于2000年Eliezer Yudkowsky创立的奇点研究所(后更名为MIRI)。Yudkowsky无正规学术背景,自诩为唯一看清AI危险并肩负拯救人类使命的“先知”。
  • 传播路径:通过LessWrong论坛、《哈利·波特与理性之道》(HPMOR)同人小说以及Scott Alexander的博客Slate Star Codex吸引技术精英。社群提供了一套解释世界的话语体系,使自认智力优越但社交脱节的个体获得归属感。
  • 仪式化:发展出“世俗冬至”(Secular Solstice)等仪式,由Raymond Arnold等人在全球举办,强化成员对AI灭世危机的集体焦虑与使命感。

2. 社群内部的结构性问题

  • 精神控制与纠错:应用理性中心(CFAR)等组织以“思维修炼”为名,对成员进行心理干预(称为“debugging”)。前员工承认滥用权威扭曲学员自我认知,导致睡眠、人际关系和道德判断受损。
  • 极端派系与暴力:衍生出激进派系“齐兹派”(Zizekians),其理论直接源自理性主义教义,涉及至少六起命案。社群内多边恋与权力关系重叠,个体难以拒绝而不牺牲整个社交网络。
  • 优生学倾向:MIRI和牛津大学人类未来研究所(FHI)曾探讨通过胚胎选择增强认知能力,将AI安全与生殖优化挂钩,引发伦理争议。

3. 与反民主政治势力的合流

  • 新反动主义:Curtis Yarvin(化名Mencius Moldbug)提出“拆除民主”、建立主权企业化治理的“Patchwork”理论,主张废除新闻自由和公民治理权。
  • 政治渗透:亿万富翁Peter Thiel长期资助理性主义社群及Yarvin。Yarvin的思想通过Thiel和JD Vance影响特朗普政府,Vance承认受其影响。Thiel还将AI安全倡导者列为“敌基督军团”,显示社群内部存在派系分裂。

4. AI安全治理的制度缺陷

  • 缺乏独立监督:Coxon的警告虽可能真诚,但评估者与被评估者同属一个四五十人的核心熟人圈,缺乏利益冲突回避机制。
  • 监管俘获风险:AI安全话语被少数“先知”垄断,形成封闭的利益共同体。真正需要的不是依赖个别专家,而是建立强制性利益申报、独立复现机制和外部监督,防止监管被大公司或封闭圈子俘获。

值得关注

  • 信任危机:主流媒体因内容的荒诞性难以严肃报道,但该亚文化对AI监管政策的实际影响力不容忽视。
  • 制度重构需求:事件暴露出当前AI安全治理过度依赖特定亚文化群体的价值观,亟需引入多元化的外部监督机制,以确保AI发展的安全性与公共利益的一致性。

准备好启动您的定制项目了吗?

现在咨询,即可获得免费的业务梳理与技术架构建议方案。