Claude Opus 5:Anthropic将性能提升一倍且价格不变,但仍落后于Fable 5

开发与编程 Jul 24, 2026加入收藏

Claude Opus 5:Anthropic将性能提升一倍且价格不变,但仍落后于Fable 5
插图 : Momiji Shirogane

将于2026年7月24日发布,Claude Opus 5 保持 Opus 4.8 的定价结构(每百万 token 5 美元 / 25 美元),同时在 Frontier-Bench v0.1 上的分数翻倍,并在 CursorBench 3.2 的 Fable 5 测试中以半价达标。Anthropic 的定位:「以半价提供前沿智能」。

具体案例

一个技术主管已经将其 CI 流水线接入 Claude Sonnet 4.6 或 Opus 4.8,每次 Anthropic 发布新品时都会思考:“是否值得修改 ANTHROPIC_MODEL 变量?”。随着 2026 年 7 月 24 日发布的 Opus 5,答案开始变成“几乎立即值得”——前提是你关注了正确的基准测试。

具体变化

Anthropic 同时发布两份公告:面向大众的发行说明面向技术的系统卡。核心理念:“性能翻倍,价格不变”

以下三项数据来自官方博客,值得关注:

  • Frontier-Bench v0.1:Opus 5 的得分是 Opus 4.8 的 两倍,且推理成本更低。
  • ARC-AGI 3:得分是第二名基准测试模型的 三倍——这是本次发布中最引人注目的指标。
  • OSWorld 2.0(操作系统代理):以 三分之一的价格 超越 Claude Fable 5。
  • CursorBench 3.2(Cursor 编辑器中的代码辅助):性能达到 Fable 5 的 0.5%价格减半

定价与 Opus 4.8 保持一致输入每百万 token 5 美元输出每百万 token 25 美元。新增“快速模式”,可将吞吐量提升 2.5 倍(价格翻倍)——适用于 Claude Code 或交互式流水线,延迟会严重影响体验。

Opus 5 的不足之处

仔细阅读公告后不难发现,Anthropic 也坦承了两点局限:

  1. Fable 5(Anthropic 于 2026 年中发布的前内部模型)在 某些 基准测试中仍领先 Opus 5——Opus 5 在 CursorBench 上仅以 0.5% 的差距接近,但并未全面超越。
  2. Mythos 5(主要竞争对手,公开信息有限)在 网络安全攻击任务 上仍优于 Opus 5。Anthropic 并未掩饰这一点——公告中明确写出,这在模型发布公告中实属罕见。

对于构建代码审计代理的开发者而言,这一点至关重要:Opus 5 在代码生成与审查方面表现优异,但在“帮我找出这个 Rust 项目的 CVE”这类任务上稍显逊色。

可用性

  • API:模型标识符 claude-opus-5
  • Claude.aiClaude CodeClaude Cowork 均已同步更新。
  • Claude Max 订阅 默认启用。
  • Claude Pro 订阅(高于 Sonnet)的最佳选择。

公告中未提及 上下文窗口大小——这将成为开发者讨论的焦点,尤其是在使用 Claude Code 处理大型代码仓库时。

关键要点

如果你已使用 Opus 4.8,切换到 claude-opus-5 是明智之举相同价格,代理任务性能翻倍。如果因成本原因使用 Sonnet,此次发布不会颠覆你的选择——但 Opus 5 的快速模式值得在延迟敏感的交互式任务中测试。同时,请记住 Anthropic 也承认 Opus 5 并非在所有领域都领先,尤其是在攻击性安全测试方面。

Resources

本文由人工智能撰写,并经人工编辑审核。

我们的编辑部
这篇文章对您有帮助吗?

2 人赞了这篇文章

K
Kaito KuroganeSenior Dev Writer
Senior polyvalent developer, backend Go + frontend TS, open source contributor.
分享:
LIVERadio Geek Kitsune
Tap to listen, the same sound for everyone
0··
// Schedule
// all stations
// share a track →
主题
浏览
信息