7.6
深览指数
科技虎嗅·黄天媛··AI 生成

OpenAI、Anthropic邀您进入“大模型折扣季”

文章报道了2026年9月23日Anthropic与OpenAI几乎同时发布新模型(Claude Opus 5.5及GPT-6 Sol/Luna)的竞争事件,核心看点在于双方策略分化:Anthropic以Opus 5.5性能逼近旗舰Fable但大幅降价,OpenAI则通过Sol和Luna的阶梯定价体系覆盖不同用户层。作者点出降价背后的隐性成本——高推理强度可能导致总花费不降反升,并引用了第三方测试数据揭示能力提升不均衡的现象。适合关注AI模型价格战与商业策略的从业者阅读。原文 ↗

核心观点
  • Anthropic和OpenAI同一天发布新模型,但策略分化:前者用Opus 5.5性能逼近自家旗舰Fable并大幅降价,后者通过Sol和Luna形成阶梯产品矩阵覆盖不同预算用户。
  1. 01Opus 5.5标准API输入/输出价格为每百万Token 4美元/20美元,Fable 5.1为10美元/50美元;GPT-6 Sol为2美元/10美元,Luna为0.1美元/0.5美元,旗舰Astra为10美元/50美元。
  2. 02在Terminal-Bench 4.0测试中,Opus 5.5得66.4%,高于Astra的57.9%和Fable 5.1的55.8%;但在AutomationBench和科学Agent测试中,Astra仍领先。
  3. 03Anthropic内部案例显示,Opus 5.5将HAProxy从C移植到Rust用时9.5小时、成本比Fable 5.1(12小时)低51%。
  4. 04第三方机构Artificial Analysis测试表明,Opus 5.5在max档能力指数58分,但平均每个任务生成约11.9万Token(含8.4万推理Token),成本达5.98美元;high档仅1.82美元对应54分。
  5. 05Artificial Analysis数据显示,Sol单任务成本从1.99美元降至1.06美元,Luna从0.18美元降至0.07美元,但Token消耗分别从2.9万增至3.1万、4.1万增至5.1万。
  6. 06在Artificial Analysis编程指数中,Sol得分从55分升至57分,Luna则从43分降至41分。
反方 / 局限
  • Anthropic宣称Opus 5.5在Terminal-Bench等测试上超过Astra,但作者指出各测试推理设置不同,且Astra在跨应用工作流和科学Agent测试中仍领先,离“全面打爆”尚远。
  • 虽然单价降低,但高推理强度下模型生成的Token数量激增,可能导致总成本不降反升;低端模型Luna在编程能力上甚至出现倒退。
  • 沃顿教授Ethan Mollick认可Opus 5.5已有Fable级水平,但指出Claude语言过于密集的问题“还没完全解决”,与Anthropic声称的改进形成张力。
7 分钟 · 5 卡片 · 10 资料
读原文 →

概念锚点

前置背景

平行视角

未来推演

延伸追问