7.1
深览指数
科技Bestblogs·AINLP··AI 生成

Claude Sonnet 5.5 发布:干活更快,单价不变

Anthropic 发布 Claude Sonnet 5.5,API 单价不变但生成速度提升 30% 以上,低 effort 档位即可超越上代最高档。核心在于低档位效率跃升而非刷新分数上限,effort 越高收益递减,拉满反而可能因过度检查而降低任务完成质量。官方建议重新评估 effort 档位,避免为旧模型设定的过高开销。原文 ↗

核心观点
  • ▍Sonnet 5.5 的核心卖点是低档位效率跃升,而非刷新最高分;对高频编程工作流,Low 档位成本节省和速度提升比单纯拉高分数更有实际价值。
  • ▍effort 档位提高后收益递减,跨模型比较中,选择另一模型的中高档位往往比将当前模型一路推到 Max 更划算。
  1. 01CursorBench 4.0 中,Sonnet 5.5 Low 档得分 35.8%、成本 0.50 美元,已略高于 Sonnet 5 Max 的 34.1%、7.17 美元,平均步骤从 140 降到了 18。
  2. 02Sonnet 5.5 从 Xhigh 到 Max,得分仅从 53.1% 升到 55.5%,成本却从 3.88 美元涨到 9.67 美元;Opus 5.5 High 以不到一半花费取得接近 Sonnet 5.5 Max 的得分。
  3. 03效率提升来自更短的行动链和更常合并工具调用。Base44 的 118 次应用构建测试中,Sonnet 5.5 平均 3.6 轮迭代,Opus 5 用了 7.7 轮,成品评分相当。
  4. 04FrontierCode 评估中,Sonnet 5.5 Xhigh 得分 52.1%,Max 反而 46.2%,原因是 Max 更常触发 Claude Code 的 code-review skill,拆分检查给子 Agent 导致超时或超范围修改。
  5. 05API 单价不变:每百万输入 token 2 美元、输出 token 10 美元。官方建议迁移时重新评估 effort 档位,默认从 Medium 开始。
5 分钟 · 5 卡片 · 10 资料
读原文 →

前置背景

技术原理

应用场景

平行视角

未来推演