Claude Opus 5 发布:半价追平旗舰 Fable 5,主动验证与安全回退成亮点

2026/07/25 09:33阅读量 2

Anthropic 发布闭源模型 Claude Opus 5,性能在多项评测中逼近顶级模型 Fable 5,但成本仅为后者一半。模型新增可调节思考档位与主动验证结果能力,同时强调安全设计,触发高风险请求时自动回退至 Opus 4.8。此外,团队发现为 Claude 5 系列编写提示词时可大幅精简规则,提示工程正从“详细约束”转向“下放判断权”。

事件概述

Anthropic 于 2026 年 7 月 25 日发布闭源模型 Claude Opus 5,主打“半价追平 Fable 5”策略。该模型在编程、知识工作、科学研究等领域表现接近旗舰级模型 Fable 5,成本仅为后者一半,同时引入可调节思考档位(effort)功能,用户可根据需求平衡推理强度、速度和成本。

核心信息

  • 性能对比:在 CursorBench 3.2 评测中,开启 max effort 档位后,Opus 5 与 Fable 5 的最高分仅差 0.5%,成本为 Fable 5 的一半;同等预算下,Opus 5 得分超过所有其他竞品。在 ARC-AGI 3(处理陌生任务)评测中,Opus 5 得分是第二名的三倍。
  • 主动验证能力:Opus 5 可对复杂任务的输出主动检查,失败后自行调整方案重试。官方示例包括自行编写算法完成 3D 重建、修复开源项目遗漏的边界 Bug、生成模拟数据验证接口代码等。
  • 社区反馈:沃顿商学院教授 Ethan Mollick 实测认为,短任务中 Opus 5 可追平甚至超过 Fable 级模型,但长任务完整度仍有差距;整体能力明显强于 Opus 4.8,已替换使用。
  • 安全设计:Opus 5 是 Anthropic 目前合规性最高的模型,失准行为得分仅 2.3。针对高风险的网络安全请求,触发安全限制后自动回退到 Opus 4.8 处理。模型在漏洞发现能力上接近 Mythos 5,但尚无法生成可落地的攻击利用代码。
  • 定价与上线:Opus 5 已全平台上线,API 模型名称为 claude-opus-5,每百万输入 token 5 美元、每百万输出 token 25 美元,与 Opus 4.8 价格一致。另有 Fast 模式(2.5 倍速度,2 倍价格)。同步上线两个 beta 更新:对话中动态修改工具不失效、被拦截请求可自动转其他模型处理。

值得关注:提示工程新趋势

Anthropic 工程师 Thariq Shihipar 指出,为 Claude 5 系列编写指令时可大幅减少系统提示词。Claude Code 的系统提示词被删除 80% 以上后,编程评测成绩无明显下降。过去强调的“制定详细规则、提供示例、一次性给全信息、重复强调要求”已逐渐过时,新的建议是:让模型根据上下文自主判断、优化工具参数、按需加载信息、关键要求只写一次。Anthropic 还推出 claude doctor 命令,可自动检查并建议精简过度臃肿的 skill 和 CLAUDE.md 文件。

准备好启动您的定制项目了吗?

现在咨询,即可获得免费的业务梳理与技术架构建议方案。