美国首次叫停前沿模型访问:AI出口管制从芯片延伸到模型权限
美国以国家安全为由,要求Anthropic暂停境外用户及在美外国公民访问Claude Fable 5和Claude Mythos 5两款前沿模型,标志着AI模型访问权首次被纳入出口管制。围绕“越狱”风险、智能体安全及地缘竞争,模型访问限制的利与弊引发广泛讨论。
2026年6月12日,美国人工智能公司Anthropic宣布,因美国政府下达国家安全指令,暂停客户访问Claude Fable 5和Claude Mythos 5两款前沿AI模型。限制对象包括美国境外用户、身处美国的外国公民,以及Anthropic内部的外籍员工;由于短时间内无法逐一核验用户身份,公司暂时关闭了所有客户的访问权限。
此前美国对AI的出口限制主要针对高端芯片、先进制程设备和云算力,此次事件将监管对象延伸至模型访问权。前沿模型提供的代码分析、漏洞发现和科研辅助能力,开始被纳入国家安全审查。
围绕模型“越狱”风险,Anthropic与美政府存在分歧。Anthropic称政府列举的案例仅为少量已知的低级别漏洞,其他公开模型同样可能发现这些问题,不足以证明Fable 5构成特殊风险。北京邮电大学张熙教授指出,美国政府高度关注“越狱”攻击,因其可能让模型绕过安全限制,尤其在化学、生物、放射、核(CBRN)领域放大风险,降低恶性事件执行门槛。现实案例中,美国现役军人Mattew Lirelsberger在特朗普国际酒店门前爆炸案中曾咨询ChatGPT自制炸弹,显示出模型连接高风险知识与操作步骤的潜在危害。
关于模型能力分级和攻防通用性,复旦大学张晓寒副研究员表示,大模型在代码解析、漏洞研判、概念验证代码构造和补丁校验等方面具有攻防通用性。防御者关注漏洞定位与修复,攻击者则试图规避检测、隐蔽痕迹、留存权限并自动化入侵。由于攻击者可通过拆解任务、分步提问绕过限制,风险评估需考虑连续任务能力、工具权限和使用场景。
智能体的加入进一步放大风险。复旦大学戴嘉润副研究员指出,新一代模型接入智能体框架后,可调用工具、访问代码库、联网检索并持续执行复杂任务。其团队自2024年以来的监测显示,前沿模型在代码理解、漏洞定位、利用链推理和长程任务规划方面进步明显,即使配备简单智能体框架也可能发起自主攻击。治理对象应包括模型、工具、权限和运行环境,而非孤立的模型接口。
对访问限制的利弊,张晓寒认为其可减少低门槛攻击者批量获取自动化漏洞发现能力,减缓攻击技术扩散;但攻击者仍可使用私有部署开源模型和地下工具,而合规研究人员、中小企业安全团队和开源项目维护者可能失去先进模型帮助,若管制主要约束守规矩的使用者,反而会削弱漏洞发现和修复能力,拉大攻防差距。
此次事件还反映地缘政治与AI治理规则变化。美国正在考虑建立分层访问制度:本国及“可信伙伴”优先获得先进模型能力,其他国家和地区受到不同程度限制,模型开始带有类似高性能芯片的地缘政治属性。
对中国而言,海外模型服务因出口管制可能随时中断,企业和科研机构通过API调用先进模型的模式面临不确定性。国内需要继续建设自主模型、推理框架和算力体系,也要补上安全评测、红队测试和行业应用规范。发展模型能力与控制安全风险需同步推进,模型越早进入真实生产环境,两者越需要协同。
