5.2
深览指数
科技量子位·梦晨··AI 生成

业内首款超算+智算的大规模计算底座,在WAIC上我们找到了

本文报道太初元碁在WAIC 2026上发布的T2 Ultra芯片与HyperIntelliX超智融合计算系统。核心主张是国产算力竞争已从单卡性能比拼进入系统级效率与生态协同阶段。作者通过介绍其HCU异构融合架构、双模式设计与AI4S(科学计算)落地案例,强调其差异化在于构建从芯片到安全体系的完整基础设施,而非做单一替代品。适合关注国产芯片产业趋势、AI基础设施与系统架构的读者。原文 ↗

核心观点
  • 国产算力竞争已从单卡性能比拼转向系统级全栈效率的比拼,降低单位算力成本是核心命题。
  • 太初元碁的差异化在于构建从底层HCU芯片到中层系统/生态,再到上层安全体系的完整AI基础设施,而非单一芯片替代者。
  1. 01T2 Ultra芯片采用HCU异构融合架构,将CPU与AI算力核(XPA算力阵列)放在同一条高速总线上,支持M:N可重构配比,以应对Agentic AI时代CPU负载的结构性提升。
  2. 02T2 Ultra支持双模式设计:自主计算模式(独立承担完整任务)与加速模式(配合主机协同),可覆盖边缘到大型集群等多种部署场景。
  3. 03T2 Ultra的HPC算力(FP64)为38 TFLOPS,FP4算力高达4800 TFLOPS(稀疏算力),FP16算力1200 TFLOPS(稀疏算力),原生支持全精度覆盖。
  4. 04太初元碁在WAIC上发布了AI4S计算平台,已在气象预测、量子模拟(TecoQSim)、虚拟药物筛选等方向落地,并联合清华大学、百度等高校与产业伙伴合作。
  5. 05该公司联合七家单位发布全域大模型安全系统,覆盖可信算力底座、安全评测治理平台、数据合规与安全实训中心,瞄准政务、金融等敏感领域落地需求。
  6. 06国产芯片生态建设有两条路线:GPGPU路线(兼容CUDA)与华为MindSpore自主生态路线。太初元碁走前者,通过适配PyTorch、vLLM等主流框架,降低迁移成本,声称可满足80%-90%主流场景适配需求。
  7. 07行业调研显示,模型向国产算力迁移的完整适配周期约需3-6个月,其中约60%的工作量集中在性能调优阶段。
反方 / 局限
  • 国产AI芯片市场正从政策驱动向市场驱动转型,头部3-5家占据80%+份额的洗牌窗口即将开启,太初元碁能否在万卡/十万卡集群规模化部署中证明系统稳定性,及能否持续降低开发者迁移门槛,是从'可用'走向'好用'的关键挑战。
12 分钟 · 4 卡片 · 12 资料
读原文 →

前置背景

平行视角

未来推演

延伸追问