Anthropic发布Fable 5.1与Mythos 5.1:性能屠榜、成本大降及反蒸馏机制上线
2026/09/02 10:18阅读量 3
Anthropic正式发布Fable 5.1和Mythos 5.1模型,在8项公开基准测试中均获第一,尤其在科研与代码领域表现显著优于前代及竞品。Fable 5.1缓存读取价格大幅下调75%,典型工作负载成本最高降低45%。同时,新API引入反蒸馏机制,通过签名校验防止上下文篡改,并优化了多轮对话中的思维链安全性。
事件概述
Anthropic于2026年9月2日发布新一代模型Fable 5.1和Mythos 5.1。Fable 5.1面向所有用户开放,而Mythos 5.1仅通过受信访问计划提供给经过审核的网络安全和生命科学机构。两款模型在多项基准测试中取得领先地位,并伴随显著的定价调整和安全机制升级。
核心性能与定价
- 基准测试表现:Fable 5.1和Mythos 5.1在8项公开基准测试中全部排名第一。在科学研究和代码生成任务上,表现明显优于Fable 5及GPT-5.6 Sol。使用中等或低推理程度的Fable 5.1,其表现大致相当于老版Mythos 5开启极高甚至最高推理程度。
- 长程任务稳定性:Fable 5.1擅长处理多步骤任务,能在长达40步的流程中保持输出稳定,避免微小错误导致的连锁崩溃。若遇难题,模型会明确告知已尝试的方案及卡点。
- 写作风格优化:减少了粗体、标题、列表或引号的使用,对风格提示词的遵循度更高。
- 价格调整:
- 缓存读取:降至每百万token 0.25美元,降幅达75%。
- 输入/输出:保持不变,分别为每百万token 10美元和50美元。
- 总体成本:典型工作负载成本比Fable 5降低约25%,高度智能体化任务最高可节省45%。
科研实战成果
Anthropic展示了模型在三个科学领域的实际应用效果:
- 蛋白质设计:Mythos 5.1设计的结合蛋白亲和力是Adaptyv Bio竞赛最佳方案的10倍,在12个靶标上的命中率接近50%(行业典型水平为10%-15%)。
- 天文学:Fable 5.1基于NASA麦哲伦号雷达图像训练神经网络,为金星三分之一表面生成了高分辨率地形图。分辨率提升至2-3公里(此前为10-20公里),高度精度提高25%,数据已以CC协议开源。
- 计算生物学:Mythos 5.1通过编写自定义GPU内核,将7个开源深度学习模型的运行速度提升最高2.5倍,且输出一致。此举可将GPU成本降低30%-60%,原本需数周的性能工程工作现仅需数天完成。
安全更新:反蒸馏机制上线
针对API调用,Anthropic引入了新的反蒸馏安全措施,主要变化如下:
- 机制原理:为每个思维链区块添加签名。当用户重新发送助手回复时,系统验证当前模型权限及对话历史(含系统提示词、工具列表等)是否被篡改。任何改动都会导致签名校验失败。
- 触发失效的操作:编辑/删除/重排消息、修改顶层系统提示词、增删改工具列表、中间抽取思维链区块、引用内容发生变化的URL等。
- 安全操作:末尾追加消息、从头移除区块、修改请求参数(如max_tokens)、增减cache_control标记、服务端压缩或上下文编辑。
- 处理方式:开发者可通过
prefix_mismatch_behavior参数设置行为。默认值为error(返回400状态码);设为drop_block则静默丢弃失效区块及后续内容,不计费并在响应中标记。 - 替代方案:提供对话内系统消息、轮次级系统消息、tool_addition/removal区块等服务端功能,以在不篡改历史记录的前提下实现指令动态调整。
其他安全策略调整
- 网络安全:误报率降低60%,允许用于漏洞发现,但禁止开发漏洞利用程序。渗透测试等双重用途任务仍路由至Opus系列模型。
- 生命科学:基础生物/医学问题误报率降低85%,涉及研发查询仍路由至Opus模型,专业人员需通过LSVP计划获取Mythos 5.1访问权限。
