7.8
深览指数
科技虎嗅·TechSugar©··AI 生成

英伟达为什么突然让CPU重新变得重要?

英伟达推出自研Vera CPU,核心动机并非让CPU重回舞台中心,而是为了AI工厂中昂贵的GPU不再因CPU等待而闲置。文章深入拆解了智能体AI工作流对CPU性能的新要求(单线程、低延迟、高带宽),指出传统CPU评价标准正从“每美元核心数”转向“每瓦特Token产出”。作者认为,Vera的真正威胁并非与Intel/AMD的直接竞争,而是英伟达将竞争从部件升级为完整计算系统,试图定义“AI工厂”的底层架构。适合对AI基础设施、芯片架构博弈及产业竞争格局感兴趣的深度读者。原文 ↗

核心观点
  • 英伟达推出Vera CPU的核心动机不是为了复兴CPU,而是为了提升昂贵GPU的利用率,防止智能体AI工作流中CPU成为计算瓶颈。
  • AI领域的竞争基本单位正从单颗CPU或GPU,升级为以每机架Token产出和每兆瓦智能为衡量标准的完整计算系统。
  1. 01智能体AI工作流的特点(代码编译、环境切换、数据检索、KV Cache管理)导致任务在CPU与GPU间频繁往返,单线程性能与低延迟比核心数更重要。
  2. 02Vera CPU采用88个自研Olympus核心,放弃多核堆叠路线,专注于单线程性能、片内缓存一致性(3.4TB/s剖分带宽)和1.8TB/s的CPU-GPU一致性连接。
  3. 03英伟达将CPU评价标准概括为“每美元和每瓦电力能够生产多少Token”,而非传统的“每美元核心数”。
  4. 04Vera的主要应用场景是Vera Rubin NVL72等英伟达AI机架系统,而非作为通用CPU单独销售,目标是与GPU、网络、DPU构建垂直整合系统。
  5. 05Intel Xeon 6被用于英伟达DGX Rubin NVL8系统,表明在通用生态中仍需x86,但Vera瞄准的是价值最高的AI机架核心。
  6. 06英伟达公布Perplexity、纽交所等早期测试案例,显示Vera在代码编译、Python执行等场景性能亮眼,但数据主要来自英伟达及合作伙伴,测试对象为预量产系统。
反方 / 局限
  • 文章主动质疑“智能体CPU”是否为营销包装,指出基础计算原理未变,只是任务发生频率和负载强度被智能体AI放大。
  • Vera面临的实际挑战:LPDDR5X的容量、成本和数据中心可维护性;Arm软件生态能否支撑复杂企业应用;迁移平台和重构软件的成本收益比。
  • 作者预测Vera不会统一CPU市场,而是促使市场分裂为通用x86、云厂商自研、AI工厂CPU和行业专用Arm处理器四种路线。
16 分钟 · 5 卡片 · 15 资料
读原文 →

概念锚点

前置背景

平行视角

未来推演

延伸追问