6.0
深览指数
科技量子位··AI 生成
不同模型厂同一家Agentic Infra,AGI时代的地基终于浮出水面
文章揭示了国产头部大模型公司(Kimi、智谱、MiniMax、阶跃星辰)相继与AI Infra公司无问芯穹达成深度合作的现象。核心观点是,随着推理需求爆发和算力供给缺口扩大,无问芯穹通过“前店后厂一中心”的Agentic Infra战略,提供从算力调度、Token工厂到行业解决方案的完整系统,试图成为大模型时代的“共同选择”。文章详细介绍了其技术优势,包括跨集群异构PD分离架构、运维智能体等,并对比了海外对标公司。适合关注AI基础设施、大模型商业落地、算力生态的读者,有助于理解当前国产大模型产业的关键竞争环节。原文 ↗
核心观点
- ▍国产头部大模型公司(Kimi、智谱、MiniMax、阶跃星辰)在同一家AI Infra公司(无问芯穹)上达成共识,而该公司试图成为大模型时代的“共同选择”和“基础设施层”,类似宁德时代在电池领域的角色。
- ▍无问芯穹的完整商业模式并非卖Token,而是通过“前店后厂一中心”的Agentic Infra战略,提供从算力集散、Token工厂到行业解决方案的系统性竞争力。
- 01在WAIC论坛上,MiniMax和阶跃星辰同时出现在无问芯穹的论坛现场,前者战略签约,后者发布演讲。
- 024个月前的中关村论坛上,智谱张鹏和Kimi杨植麟曾与无问芯穹CEO同框参与圆桌,并现场点名其已为Kimi、智谱提供服务。
- 032026年,推理需求爆发,中国日均Token调用量突破140万亿,一年涨了四成;而物理算力扩产逻辑是线性的,缺口三五年内填不平。
- 04针对模型效果滑坡问题,无问芯穹制定了准入测试标准,确保客户通过其平台和原厂API的体验几乎无差别。
- 05自研的跨集群异构PD分离架构,将Prefill和Decode拆开部署,并首创PDD架构(P、RelayDecode、MainDecode三级),TTFT降低51.5%,单Token成本降低37.5%。
- 06发布“智算集群运维智能体系统”,实现运维人效提升5倍以上,关键故障处理效率提升6倍。
- 07无问芯穹的“算力集散中心”已部署触达37000P算力,覆盖接入16种主流芯片。
- 08截至7月,无问芯穹Agentic MaaS平台的日均Token调用量较去年12月涨了40倍。
- 09海外对标公司Baseten、Together AI、Fireworks AI估值在130亿到150亿美元区间,但底层都建在英伟达单一生态上,而无问芯穹面对更碎片化的国产芯片生态,将多元异构作为护城河。
反方 / 局限
- — 文章本质上是一篇企业宣传稿,对无问芯穹的技术优势、客户合作和商业模式进行了高度正面和系统性的呈现,但未提及任何潜在的技术局限、市场竞争风险(如来自字节跳动、百度等大厂自研Infra的竞争)、或客户粘性可能存在的挑战。
- — 海外对标公司(如Together AI)估值与其提供的服务价值之间存在巨大泡沫,而文章并未探讨这种估值逻辑在国产化单一市场中的可持续性。
10 分钟 · 4 卡片 · 11 资料
读原文 →