6.8
深览指数
科技智东西·ZeR0 佛系码字,日常闲置。··AI 生成

杀进机器人赛道,面壁智能怎么打出差异化?对话首席科学家

面壁智能发布MiniCPM-Robot系列具身智能模型,以1.5B参数实现比肩3-4B模型的性能,推理成本减半,并支持1分钟原生记忆。文章通过对话首席科学家,阐述了面壁智能做具身智能的三大核心策略:走'先通后专'的通用模型路线、只做模型不碰本体、发挥端侧高效多模态技术优势。对于关注端侧AI与具身智能技术路线,以及大模型公司差异化竞争策略的读者,此文提供了来自一线玩家的一手判断。原文 ↗

核心观点
  • 面壁智能的具身智能策略核心是'先通后专',先打造通用基础模型,再适配具体场景,而非针对单一任务训练专家模型。
  • 面壁智能在具身智能领域只做模型、不碰本体,希望通过与吉利、乐聚等本体厂商合作,嵌入终端生态,走类似安卓的生态路线。
  1. 01MiniCPM-RobotManip模型以1.5B参数,在RMBench测试中,处理60帧历史观测任务时,单决策步推理时延为120ms,低于π0.5的234ms。
  2. 02MiniCPM-RobotTrack模型是业内首个支持真实本地断网部署的跟踪模型,适配宇树Go2 Edu,稳定达到5+ Hz,端到端响应时延约180毫秒。
  3. 03面壁智能与吉利机器人合作,VLM模型已集成到其生产仓储场景;与乐聚机器人合作推出展厅导览Agent,覆盖6大类商用场景,检测成功率超95%。
  4. 04面壁智能在视觉Token压缩上实现16倍无损压缩率,远超业界主流的4倍,这是其实现高效记忆与低推理成本的核心技术壁垒。
  5. 05截至2026年6月30日,面壁智能MiniCPM开源模型系列累计下载量突破3800万次。
反方 / 局限
  • 文章提到,端侧模型受限于算力与模型尺寸,当前仍然比较专用,可处理的任务类型有限,达到GPT-5.6级水平还需1-3年。
  • 刘知远承认,当前具身智能行业面临共同的数据瓶颈,没有一种数据是完美的,且具身智能的'ChatGPT时刻'尚未到来。
13 分钟 · 4 卡片 · 11 资料
读原文 →

前置背景

技术原理

平行视角

延伸追问