7.4
深览指数
热点智搜··AI 生成

DeepSeekV4正式版推迟至7月底发布

DeepSeek V4 正式版发布推迟至 7 月底,目前正进行灰度测试。文章核心信息包括:V4 采用 1.6 万亿参数的 MoE 架构,性能接近 Claude Opus 4.8 和 GPT-5.6 Sol 级别;首创“峰谷计费”定价策略,高峰时段 API 价格翻倍;发布首日即适配华为昇腾、寒武纪等八大国产芯片,推动“国芯国模”自主可控。其与刚发布的 Kimi K3(2.8 万亿参数)形成正面竞争,加速大模型赛道从参数比拼转向成本效率与场景适配的较量。适合关注 AI 产业竞争格局、国产算力生态及大模型商业化的读者。原文 ↗

核心观点
  • DeepSeek V4 正式版延期至 7 月底发布,其核心竞争策略是“技术流性价比”,通过峰谷计费和国产算力适配,以极低调用门槛吸引中小开发者,与 Kimi K3 形成正面竞争,推动行业从参数比拼转向成本效率与场景适配的综合较量。
  1. 01V4 采用 1.6 万亿参数 MoE 架构,配备 100 万 Token 上下文窗口,性能接近 Claude Opus 4.8,编码能力直追 GPT-5.6 Sol。
  2. 02V4 首发日即适配华为昇腾、寒武纪、海光、摩尔线程、沐曦、昆仑芯、阿里平头哥、天数智芯等八大国产芯片,标志着“国芯国模”深度绑定。
  3. 03首创“峰谷计费”策略,高峰时段(09:00-12:00、14:00-18:00)API 价格翻倍,低峰期维持现价;V4 Flash 版百万输出 Token 谷时成本仅 0.28 美元,为海外主流模型的几十分之一。
  4. 04产品分为 Flash(轻量化)和 Pro(高性能)两个版本,灰度测试中开发者可通过思维链(CoT)第一人称代词("I'm" 或 "I'll" vs "Let me")判断是否接入了 V4 GA 版。
  5. 05Kimi K3 拥有 2.8 万亿参数,主打长文本与极致编程性能,在多项国际评测中反超海外闭源模型,与 V4 形成直接竞争。
  6. 06V4 的 Agent 自动化能力大幅增强,3D 图像和 SVG 图形生成质量提升,能独立生成复杂 3D 模拟游戏 Demo。
反方 / 局限
  • 文章未提及 V4 在非推理任务(如创意写作、多轮对话)上的表现,也未对比 Kimi K3 在长文本、编程之外的能力短板,竞争分析可能偏重单一维度。
  • 峰谷计费策略可能增加中小开发者在高峰时段的使用成本,且该策略对算力调度效率的实际效果尚未有数据支撑。
3 分钟 · 5 卡片 · 15 资料
读原文 →

前置背景

技术原理

平行视角

未来推演

延伸追问