科技Bestblogs·AINLP··AI 生成
Claude Sonnet 5.5 发布:干活更快,单价不变
Anthropic 发布 Claude Sonnet 5.5,API 单价不变但生成速度提升 30% 以上,低 effort 档位即可超越上代最高档。核心在于低档位效率跃升而非刷新分数上限,effort 越高收益递减,拉满反而可能因过度检查而降低任务完成质量。官方建议重新评估 effort 档位,避免为旧模型设定的过高开销。原文 ↗原文 ↗
核心观点
- ▍Sonnet 5.5 的核心卖点是低档位效率跃升,而非刷新最高分;对高频编程工作流,Low 档位成本节省和速度提升比单纯拉高分数更有实际价值。
- ▍effort 档位提高后收益递减,跨模型比较中,选择另一模型的中高档位往往比将当前模型一路推到 Max 更划算。
- 01CursorBench 4.0 中,Sonnet 5.5 Low 档得分 35.8%、成本 0.50 美元,已略高于 Sonnet 5 Max 的 34.1%、7.17 美元,平均步骤从 140 降到了 18。
- 02Sonnet 5.5 从 Xhigh 到 Max,得分仅从 53.1% 升到 55.5%,成本却从 3.88 美元涨到 9.67 美元;Opus 5.5 High 以不到一半花费取得接近 Sonnet 5.5 Max 的得分。
- 03效率提升来自更短的行动链和更常合并工具调用。Base44 的 118 次应用构建测试中,Sonnet 5.5 平均 3.6 轮迭代,Opus 5 用了 7.7 轮,成品评分相当。
- 04FrontierCode 评估中,Sonnet 5.5 Xhigh 得分 52.1%,Max 反而 46.2%,原因是 Max 更常触发 Claude Code 的 code-review skill,拆分检查给子 Agent 导致超时或超范围修改。
- 05API 单价不变:每百万输入 token 2 美元、输出 token 10 美元。官方建议迁移时重新评估 effort 档位,默认从 Medium 开始。
前置背景
技术原理
应用场景
平行视角
未来推演