7.2
深览指数
商业腾讯新闻·虎嗅APP··AI 生成
GPT-6重回第一,OpenAI也打不过Anthropic
OpenAI发布GPT-6 Astra,在多项基准测试上超越Anthropic的Claude,重新夺回模型技术领先的叙事。但文章核心判断是:模型能力领先已不能直接转换为商业成功。作者通过企业支出数据(Ramp报告显示Anthropic企业付费客户比例已超OpenAI)、Coding市场格局(Anthropic份额54%对OpenAI的21%)以及两家公司在企业工作流(Agent平台、云渠道、合作伙伴网络)上的策略趋同,论证了商业竞争胜负的关键正在从模型性能转向性价比、稳定性、企业连接能力。适合关注AI商业化、中美大模型竞争、企业软件采购决策的读者。原文 ↗
核心观点
- ▍OpenAI发布GPT-6 Astra重新夺回模型技术领先,但模型能力第一已不能转换为商业第一;企业AI竞争的关键正从性能转向性价比、稳定性和工作流集成能力。
- ▍两家竞争对手正在收敛到同一个答案:前沿模型的商业价值最终要靠进入企业工作流来兑现。
- 01GPT-6 Astra在FrontierMath Tier 4得分97.6%、ARC-AGI-3最高99.9%、ExploitBench达到100%。Artificial Analysis综合榜单中与Claude Fable 5.1以53分并列第一。
- 02Menlo Ventures估算2025年企业Coding支出达40亿美元;企业LLM API支出中Anthropic份额从2023年的12%升至40%,OpenAI从50%降至27%;Coding模型市场Anthropic达54%,OpenAI仅21%。
- 03Ramp数据显示43.5%的美国企业客户为Anthropic产品付费,OpenAI为39.7%。
- 04截至7月底,Anthropic年化收入运行率超650亿美元;OpenAI同期超400亿美元,两者差距约190亿至210亿美元。Anthropic估值9650亿美元,超过OpenAI的8520亿美元。
- 05Claude Code的出现改变了竞争格局,成为大模型商业化最成熟的场景之一。
- 06OpenAI今年以来加速企业业务:Frontier接入企业系统、Codex周活跃用户超500万(20%为非开发者)、ChatGPT Work对标Claude Cowork、建立咨询合作伙伴网络。
反方 / 局限
- — Ramp数据指出,企业客户为“额外智能”支付的意愿可能接近上限:Anthropic性能更强的Fable 5仅占其企业Token使用量的6%,而OpenAI的GPT-5.6 Sol占25%,说明模型性能领先已不能直接转换成企业使用量。
- — 文章暗示但未深入讨论:出口管制等问题可能影响价格归因,且企业采购还受稳定性、安全合规、迁移成本等多因素影响,模型第一并不等于商业第一。
8 分钟 · 4 卡片 · 9 资料
读原文 →