Anthropic Opus 5 以半价反超自家旗舰 Fable 5,定价牌局被打破
2026/07/25 12:15阅读量 2
2026年7月25日,Anthropic发布Claude Opus 5,定价仅$5/$25(每百万输入/输出token),却在编程、自主搜索、企业流程等多项基准测试中超越定价$10/$50的旗舰模型Fable 5,成本仅一半。其中ARC-AGI 3测试得分30.2%,远超此前最优的7.8%。Opus 5的发布标志着大模型“越贵越强”的定价范式终结,Anthropic主动以中端价格提供旗舰性能。
事件概述
Anthropic于2026年7月25日发布Claude Opus 5,定价$5/$25(每百万输入/输出token)。该模型在核心基准测试中全面超越定价$10/$50的旗舰模型Fable 5,部分指标甚至翻倍,直接动摇了Anthropic自身的高价定价策略。
关键数据对比
- 编程能力(Frontier-Bench v0.1):Opus 5得分43.3%,Fable 5为33.7%,差距近10个百分点。Opus 4.8仅21.1%。
- CursorBench 3.2:在最高推理强度下,Opus 5达到Fable 5峰值成绩的94.5%,单次成本仅一半。
- 自主搜索:Opus 5得分90.8%,Fable 5为87.4%。
- 计算机使用(OSWorld 2.0):Opus 5以约三分之一成本超越Fable 5最优成绩。
- 企业业务流程自动化:Opus 5得分26%,Fable 5仅17.4%。
- ARC-AGI 3流体智能测试:Opus 5获得30.2%,大幅领先此前公开最高成绩(GPT-5.6 Sol的7.8%)和Opus 4.8的1.5%。该测试衡量模型在完全陌生环境中的推理能力。
- 科学任务:有机化学任务提升10.2个百分点,蛋白质任务提升7.7个百分点。
真实案例表现
- 3D建模:Opus 5自主根据设计图纸编写代码重建FreeCAD模型,全程无人工干预,完成完整的工程验证循环。
- 客户流失预防:Zapier CEO表示,Opus 5首次100%完整交付全套流失预防流程。
- 企业效率:Box CTO Ben Kus量化对比:Opus 5在专业企业内容处理上整体提升8%,数据分析提升11%,尽职调查提升17%。法律AI团队发现Opus 5在保持质量的同时,平均少生成26%的token。
行业影响与定价策略
Opus 5的发布标志着“越贵越强”定价范式终结。Fable 5发布仅45天,其$10/$50的定价就被自家中端产品以一半成本超越。Anthropic主动拆解自己的价格金字塔,以应对来自Kimi K3等开源模型的竞争压力。对于企业用户,Opus 5在编程、自动化办公、数据分析等高频场景中成为当前最具性价比的选择。然而,7月27日Kimi K3将开源全部权重(2.8T参数),可能进一步击穿价格地板。
核心结论
Opus 5证明更强的推理架构和更高效的训练方法可以让模型在价格不变甚至更低的情况下性能跃升一个量级。旗舰模型的定义正从能力标签转向价格标签,任何维持高溢价的窗口期正在以天为单位收窄。
