6.3
深览指数
科技腾讯新闻·TechWeb··AI 生成
DeepSeek-V4-Flash登顶全球调用量榜首,国产大模型包揽前五
DeepSeek-V4-Flash 正式版上线仅一周,便以 7.1 万亿 Token 周调用量登顶全球榜首,国产模型包揽前五,中国模型周调用量已连续十四周超越美国。文章揭示了其“Agent 能力暴涨、性价比碾压”的核心竞争力:Agent 测试得分接近 Claude Opus-4.8,但运行成本不到后者的百分之一。文章立场清晰,指出 DeepSeek 在全球开发者市场划出了一条“斩杀线”,正在改写由硅谷巨头制定的定价规则。适合关注 AI 产业竞争格局、模型成本与开发者生态的读者阅读。原文 ↗
核心观点
- ▍DeepSeek-V4-Flash 正式版以极低的成本实现了接近顶级模型的 Agent 能力,这正在全球开发者市场划出一条“斩杀线”:性能与定价平衡的临界值,使得定价显著高于 DeepSeek 的模型将流失中小开发者,而性能弱于它但成本更高的产品则生存空间萎缩。
- 01根据 OpenRouter 数据,7月28日至8月3日,DeepSeek-V4-Flash 以 7.1 万亿 Token 周调用量登顶,中国模型包揽前五,分别为小米 MiMo-V2.5、腾讯 Hy3、DeepSeek-V4-Pro、智谱 GLM-5.2。
- 02在 Agent 智能体终极测试中,V4-Flash 正式版得分 25.2,接近 Claude Opus-4.8 的 25.7 分,远高于 V4-Pro 预览版的 15.8 分。
- 03美国研究机构 Artificial Analysis 的加权测试显示,V4-Flash 单任务平均成本仅 3 美分,而 GPT-5.6 Sol 高达 1.86 美元,Claude Fable 5 达到 3.15 美元,其运行成本不到 Claude Fable 5 的百分之一。
- 04海外开发者反馈,团队迁移至 DeepSeek 后月度推理成本下降 60% 至 85%。
- 05OpenAI 受压力,GPT-5.6 Luna 上线不到三周便宣布价格下调 80%。
反方 / 局限
- — 文章主要聚焦于 DeepSeek 的成功,对国产模型在高端、复杂推理任务上的实际表现与 OpenAI 及 Anthropic 旗舰模型的差距语焉不详,例如在更复杂的逻辑推理或创造性任务上,低成本的模型是否仍然是更优选择。
- — 文章未提及过度依赖低成本模型可能带来的“模型锁定”风险,以及对于对稳定性和合规性要求极高的企业级应用,DeepSeek 的生态与支持服务是否足够成熟。
DeepSeek-V4-FlashOpenRouter小米MiMo-V2.5腾讯Hy3DeepSeek-V4-Pro智谱GLM-5.2OpenCodeClaude Opus-4.8Artificial AnalysisGPT-5.6 SolClaude Fable 5Gizmodo JapanGPT-5.6 LunaKimi K3Gemini 3.6 Flash
6 分钟 · 4 卡片 · 12 资料
读原文 →