OpenAI安全团队动荡加剧:负责人离职,三名员工因泄密被解雇
2026/10/03 12:41阅读量 4
OpenAI Safety Systems团队“安全透明度”负责人David Robinson近期离职,其核心职责是撰写模型风险说明书(System Card)并起草《Preparedness Framework 2.0》。此前,OpenAI以泄露敏感基础设施信息为由解雇了Jasmine Wang、Tomek Korbak和Mikita Balesni三名安全研究员。这一系列人事变动反映了OpenAI在快速推进模型能力与维持内部安全治理之间面临的持续张力。
事件概述
OpenAI的安全治理团队近期遭遇重大人事震荡。Safety Systems团队内的“安全透明度”职能负责人David Robinson已离职,且公司尚未公布继任者。与此同时,OpenAI此前已以违反保密协议为由,解雇了三名从事安全与模型对齐研究的核心员工。这些事件发生在OpenAI频繁发布新模型及高管变动的背景下,凸显了该公司在技术激进扩张与安全合规管控之间的紧张关系。
核心信息
1. 安全透明度负责人离职
- 人物背景:David Robinson负责OpenAI的“安全透明度”工作,被视为连接技术部门与公众信任的“翻译器”。
- 核心职责:
- System Card(系统卡片):为每个重要模型发布几十页的风险说明书,详细披露训练方法、安全评估结果、高风险领域能力(如生物/网络攻击)、已采取的安全措施及剩余风险。Robinson将此工作类比为食品包装上的“营养成分表”,虽受众有限但至关重要。
- 框架起草:他是《Preparedness Framework 2.0》的主要起草人。该框架用于追踪前沿模型的严重风险,新增了对生物/化学能力、网络安全能力及AI自我改进能力的追踪。若模型能力达到“High”级别,需部署额外安全措施;若达到“Critical”级别,则可能面临开发暂停。
- 案例参考:在Deep Research的System Card中,其生物学评估显示模型正接近“High”能力门槛,即具备实质帮助非专业人士制造已知生物威胁的能力。
- 离职影响:Robinson离职前曾公开表示,公司内部对高能力AI风险的认知正在觉醒,但他质疑这种变化的速度是否足够快。他呼吁员工利用内部影响力推动更严肃的风险应对。目前,其招聘的“首位安全透明度编辑”岗位仍在空缺状态。
2. 三名安全员工因泄密被解雇
- 涉事人员:Jasmine Wang、Tomek Korbak和Mikita Balesni,主要从事安全与模型对齐研究。
- 解雇原因:据《华尔街日报》报道,内部调查证实三人将公司敏感信息分享给了一家外部AI安全机构,其中包含OpenAI的基础设施架构内容。
- 关键细节:Tomek Korbak此前担任OpenAI与第三方评估机构METR、Redwood Research之间的技术联系人。这两家机构曾在Hugging Face事件后受邀进驻OpenAI进行调查,Korbak是主要的对接人。
3. 安全团队长期动荡
- 历史背景:自Dario Amodei时期以来,OpenAI安全团队一直变动频繁。近期包括解散“灾难风险应急”团队、GPU专家Scott Gray离职、前COO离场以及多位安全主管相继离开。
- 行业观察:尽管OpenAI不断推出如GPT-6 Astra等宣称“最安全”的新模型,但其内部安全治理团队的稳定性却持续受到挑战,导致外界对其安全承诺的可信度产生疑问。
