奥特曼亲手推迟最强模型Astra,重蹈Anthropic Mythos覆辙
奥特曼宣布推迟OpenAI最强模型Astra的发布,因内部评估显示其网络安全能力可能达到“关键”级别,这是OpenAI首次有模型触及该红线。此前Astra刚公布解决10项数学难题,引发关注。此举被外界视为重蹈Anthropic Mythos推迟发布覆辙,OpenAI未给出新时间表。
事件概述
OpenAI CEO奥特曼发文宣布,推迟最强模型Astra的发布。他表示,Astra具备网络安全方面的能力,需要更多时间确保能够安全地向所有用户开放。
核心信息
Astra是OpenAI最新模型类别,建立在Sol、Terra和Luna之上,于上周首次亮相。奥特曼在华盛顿向政府展示了该模型多个Agent长时间协同工作的能力。随后,OpenAI官宣了Astra在数学领域的突破——一次性拿下10项长期悬而未决的数学与理论计算机科学公开难题,覆盖高维几何、编码理论、群论等领域,引发数学界广泛关注,甚至有人将其定义为“菲尔茨奖”级突破。
针对此前Hugging Face被攻击事件,OpenAI澄清Astra并未参与,但该事件此前曾让外界将嫌疑指向Astra。
安全评估与应对
OpenAI内部评估显示,Astra在智能体编码和网络安全方面取得显著进展,公司无法排除其在Preparedness Framework下达到“关键(Critical)”级网络能力的可能性。根据定义,达到该级别的模型能在无人干预的情况下自主发现并利用针对现实世界关键系统的零日漏洞,或仅凭高层目标描述设计执行新型网络攻击。此前发布模型包括GPT-5.6 Sol均被评定为“高(High)”级别,从未触及Critical线。
OpenAI已采取一系列措施:对高能力模型实施更严格安全控制,包括隔离测试环境、限制网络和工具访问、增强模型权重保护;暂停未达标内部活动;在Astra智能体应用中部署风险行为监控;与政府机构和AI安全组织合作进行外部测试。目前Astra的新发布时间未公布。
外界争议
今年4月,Anthropic曾以网络安全风险为由推迟旗舰模型Mythos发布,奥特曼当时公开批评这是“恐惧营销”。如今OpenAI面临同样情况。有观点认为,“安全威胁叙事”正成为前沿AI公司针对DeepSeek、Kimi等开源模型的竞争策略。从评论区看,用户对安全威胁说法并不完全买账。黄仁勋也曾指出,对开源模型的攻击多为无稽之谈,公开模型并集众人之力解决安全问题才是更好的方式。
