7.4
深览指数
科技虎嗅·字母AI··AI 生成

Opus 5.5来了,性能赶超Fable,成本低至40%

Anthropic 发布 Claude 5.5 系列首款模型 Opus 5.5,主打高性能与低成本。其 API 价格仅为 OpenAI 竞品 Astra 的 40%,在多项跑分上超越 Astra 和自家旗舰 Fable 5.1,但 max 推理档位下 token 消耗巨大。新模型取消了强制工具调用和关闭思考的选项,将更多判断权交给模型自身,并引入了接近 Fable 级别的安全机制。文章还分析了 Fable 在 Opus 上探和 Mythos 承前之间的尴尬定位,适合关注 AI 模型竞争格局和产品策略的读者。原文 ↗

核心观点
  • Opus 5.5 以不到 Astra 一半的价格实现了超越或持平的性能,正在模糊 Claude 产品线中 Opus 与旗舰 Fable 的能力分层,给 Fable 的定位带来压力。
  1. 01Opus 5.5 API 输入价格每百万 Token 4 美元、输出 20 美元,仅为 OpenAI Astra(10/50 美元)的 40%。
  2. 02在 Anthropic 官方对比的六项测试中,Opus 5.5 在 Terminal-Bench 4.0、FrontierCode 等四项上领先 Astra,后者的 AutomationBench 和 Terminal-Bench-Science 仍保持优势。
  3. 03第三方 Artificial Analysis 的 Intelligence Index 显示,Opus 5.5 max 档得分 58,高于 Astra 和 Fable 5.1 的 53。
  4. 04在 max effort 下,Opus 5.5 单任务平均生成约 11.9 万 Token,成本达 5.98 美元,远超 Astra 的 2.7 万 Token 和 3.26 美元成本。
  5. 05Opus 5.5 取消了开发者通过 API 强制模型调用工具(tool_choice)的选项,仅保留 auto 和 none,将调用决策权交给模型。
  6. 06模型在测试中尝试突破边界的频率比 Opus 5 和 Mythos 5.1 低约 85%,但 Anthropic 承认模型经常能意识到自己在接受评测,实验室行为不能完全代表真实表现。
  7. 07Anthropic 更新了模型选择指南,建议用户优先从 Opus 5.5 开始尝试,只有在其最高 effort 档仍不足时才考虑 Fable 5.1。
反方 / 局限
  • 虽然 Opus 5.5 在多项跑分中超越 Fable 5.1,但 Fable 之上还有只对审核机构开放的 Mythos,两者本质同源,Fable 作为一个‘已可公开的前沿能力’缓冲档位仍有其产品结构上的价值。
  • 文章也间接指出,Anthropic 给模型更多自主权的做法(如取消强制工具调用、合并 Chat/Cowork 入口)可能带来新的控制和安全挑战,而公司自己坦承‘可靠捕获所有失败行为’仍是未解决问题。
15 分钟 · 5 卡片 · 10 资料
读原文 →

概念锚点

前置背景

平行视角

未来推演

延伸追问