7.5
深览指数
科技虎嗅·生态学时空©··AI 生成
当红线越过蓝线:2026年,我们该如何读懂中美AI 的"错位领跑"
2026 年 2 月起,中国大模型周调用量在 OpenRouter 统计口径下持续超越美国,至 9 月领先倍数达 3.4 倍。但本文通过五维记分卡指出,这并非全面反超,而是“错位领跑”:中国在应用规模、性价比、开源采用上领先,美国在前沿能力、商业收入、算力底座上仍占优势。文章分析了调用量暴涨的价格、工程与场景驱动力,并主动揭示了 OpenRouter 样本偏倚、低价灌水、能力差距三大局限,适合需准确理解中美 AI 当前格局的从业者与投资者阅读。原文 ↗
核心观点
- ▍中美 AI 竞争已从“美国单方面领先”进入“错位领跑”时代:中国在应用规模、性价比、开源采用上领先,美国在前沿能力、商业收入、算力底座上仍占主导。
- 012026 年 2 月第二周,中国大模型周调用量 4.12 万亿 Token,美国 2.94 万亿,首次反超;至 9 月初,中国周调用量 56.72 万亿,美国 16.54 万亿,领先倍数约 3.4 倍,连续 19 周第一。
- 02从 2025 年 3 月到 2026 年 9 月,中国周调用量增长约 13.8 倍(从 0.4 万亿到 56.72 万亿),美国增长约 5.6 倍(从 1.2 万亿到 16.54 万亿),中国增速显著快于美国及全球市场(全球总量半年增长 5.6 倍)。
- 03全球牌桌上实际上只有中美两位玩家:2026 年 5 月欧洲在“模型产地”口径下占开放市场仅 1%~1.5%,法国 Mistral 是唯一进入 Top50 的欧洲模型。
- 04中国模型 API 价格普遍为 GPT-5 / Claude 的 1/5 到 1/60;DeepSeek V4 Flash 处理标准任务约 0.02 美元,而美国同类模型要价 2.75 美元,价差超 100 倍。
- 05中国调用量暴涨的三大驱动力:价格碾压、工程降本(MLA+MoE 架构、KV cache 优化、国产芯片使推理成本比 NVIDIA 方案低 40%~60%)、场景迁移至编程与 Agent 长任务。
- 062026 年 2 月的反超叠加了春节、MiniMax M2.5 / Kimi K2.5 / GLM-5 密集发布、开源智能体框架爆火等时点因素。
反方 / 局限
- — OpenRouter 只占全球 Token 消耗约 2%~4%,且不含 OpenAI、Anthropic 的直连企业大客户,系统性低估了美国模型真实体量;平台美国开发者占 47%、中国仅 6%,中国模型的高调用量大量来自海外开发者选择,反映开发者市场而非本国消费端。
- — 中国 Token 价格是美国的几十分之一,“领先倍数”中有相当部分是低价“灌”出来的,并不等价于“更好用、更被高端市场认可”。
- — 前沿模型(GPT-5、Claude、Gemini)的第一梯队位置、商业变现与算力底座仍由美国主导,能力差距依然存在。
OpenRouterDeepSeek V4 FlashMiniMax M2.5Kimi K2.5GLM-5GPT-5ClaudeGeminiMistralMLC+MoE 架构KV cache 优化Falcon
8 分钟 · 4 卡片 · 11 资料
读原文 →