8.0
深览指数
科技虎嗅·Xsignal丨奇异因子··AI 生成
世界模型被82亿美元买下之后:AI正在从生成内容走向生产力
文章以AMD收购李飞飞创办的World Labs为引子,提出核心观点:AI的Scaling范式正从'信息'迁移到'世界'。作者将这一轮产业跃迁拆解为五道逻辑门槛:World、Experience、Action和Productivity能否分别实现规模化。文章不仅分析了Atlas世界模型和具身智能的技术路线,还引入27亿AI用户规模、京东1000万小时真实场景视频等产业数据,论证Physical AI将从Content Economy走向Physical Economy。适合关注AI产业投资、具身智能技术和下一代AI基础设施的读者。原文 ↗
核心观点
- ▍AI下一阶段的Scaling对象正从'Information'向'World'迁移,Physical AI将依次经历World、Experience、Action和Productivity四道规模化门槛。
- ▍具身智能不是生成式AI之后的另一个垂直赛道,而是生成式AI下一阶段最大的一次价值迁移:从Content Economy走向Physical Economy。
- 012026年9月28日,AMD宣布以约82亿美元全股票方式收购World Labs,李飞飞将加入AMD担任执行副总裁兼首席科学家。
- 022026年8月,全球AI应用活跃用户规模达到27.72亿,ChatGPT活跃用户达13.24亿(Xsignal AI Holo数据)。
- 03World Labs于2026年9月1日发布Atlas世界模型,将Autoregressive、Diffusion、多模态理解与3D Spatial Context纳入同一基础架构。
- 04京东在2026年9月9日JDDiscovery-2026上提出未来两年累计采集超过1000万小时真实场景视频数据,首批数据已开放。
- 05李飞飞将World Model划分为Renderer(输出Observation)、Simulator(描述State)、Planner(Action)三类功能。
- 06NVIDIA从基础设施侧推进Physical AI技术栈,包括Cosmos World Foundation Model、Isaac Simulation和GR00T机器人基础模型。
- 07宇树H2 Plus人形机器人搭载Jetson T5000,提供多视角视觉和可选触觉灵巧手,明确支持Isaac GR00T及从数据到部署的开发工作流。
- 08RT-2将机器人动作表示成类似Token的形式,Diffusion Policy将扩散模型带入机器人控制,π0采用Flow Matching生成连续动作。
反方 / 局限
- — 1000万小时人类视频不能等同于1000万小时Robot Trajectory,普通视频不包含完整的机器人关节状态、控制信号、力觉和触觉。
- — 机器人会做一件事不等于这件事值得交给机器人。Physical AI真正的核心指标最终是商业数字:有效自主工作时间、人工接管率、单位任务成本。
17 分钟 · 5 卡片 · 15 资料
读原文 →