6.7
深览指数
热点智搜··AI 生成

DeepSeek获1.6万张华为昇腾卡跑通国产算力生态

DeepSeek创始人梁文锋透露已获得1.6万张华为昇腾950卡,并认为其性能可完全平替英伟达GB系列,但价格贵50%-200%、时间落后约两年。文章披露了V4模型全链路脱离CUDA转向华为CANN框架的技术细节,以及由此引发的阿里、字节等大厂抢购华为芯片的市场反应。文章核心判断是国产AI算力生态正从‘依赖海外’转向‘全栈自主’,但自研芯片与深度绑定华为的‘竞合’路线也暗示了风险。适合关注AI产业国产化、算力供应链及中美科技竞争格局的深度读者。原文 ↗

核心观点
  • DeepSeek与华为的合作已进入底层算力集群深度协同阶段,标志着中国AI产业从‘依赖海外’向‘全栈自主’的历史性突围,英伟达构筑的CUDA生态壁垒正在被实质性打破。
  1. 01DeepSeek已获1.6万张华为昇腾950卡,算力约相当于4000张英伟达B系列芯片,梁文锋认为其性能可完全平替英伟达GB200/GB300,但价格贵50%-200%,且时间落后约两年。
  2. 022026年4月发布的DeepSeek V4模型,团队花费数月重写40万个算子,实现了从训练到推理全链路脱离英伟达CUDA生态,转向华为CANN框架。
  3. 03V4在华为芯片上的成功运行引爆市场需求,阿里、字节、腾讯等大厂争相采购华为昇腾950PR芯片达数十万颗,导致该芯片价格短期上涨20%。
  4. 04DeepSeek正全力开发高级语言编译器TileLang,旨在摆脱对英伟达CUDA生态的依赖,预计一年内扭转市场对国产卡‘用不起来、不好用’的认知。
  5. 05英伟达CEO黄仁勋曾警告‘如果DeepSeek先在华为平台上发布,对美国将是灾难性的’,V4的昇腾首发适配被外界视为AI生态主导权转移的标志。
反方 / 局限
  • 文章虽强调‘完全平替’,但具体数据对比显示华为昇腾950在算力密度上需4张卡顶1张英伟达卡,价格贵50%-200%,且发布时间落后约两年,这意味着‘平替’在成本效率和代际差距上存在显著局限。
  • DeepSeek在深度绑定华为的同时,正秘密推进自研AI推理芯片,这一‘竞合’路线暗示了对华为单一供应商依赖的警惕,以及追求软硬件极致协同的长期战略,而非简单的‘全栈自主’。
4 分钟 · 4 卡片 · 9 资料
读原文 →

前置背景

平行视角

未来推演

延伸追问