7.6
深览指数
科技虎嗅·AppSo··AI 生成

号称人类造的最后一个AI 要来了,刷屏全网的RSI 是什么

本文拆解了AI圈新热词RSI(递归自我改进)的含义、技术层级与产业博弈。文章指出,RSI的核心是让AI自主改进研发流程,以实现加速迭代,并介绍了从L1到L5的自主性分级。作者认为,当前关于RSI的末日安全叙事,本质上是头部公司争夺算力、资本和产业利益的工具,安全审查的高成本实际构成了扼杀竞争者的壁垒。适合对AI前沿技术概念与产业生态博弈感兴趣的深度读者。原文 ↗

核心观点
  • RSI(递归自我改进)是AI让AI设计更优下一代的学习和研发流程,一旦实现,AI将脱离人类工程师的控制,加速迭代直至“智能爆炸”。
  • 当前围绕RSI的末日安全叙事,本质上是头部AI公司争夺算力、资本和产业利益的政治工具,安全审查的高门槛反而构成了它们的竞争护城河。
  1. 01上海交大、清华、字节跳动等机构研究者提出了RSI的L1至L5五级自主性模型,L5阶段AI能修改改进机制本身。
  2. 02OpenAI内部报告显示其“自动化研究实习生”系统在人类指导下可独立完成编码、实验、分析等任务,每投入1个人类工作日,智能体运行时长相当于3.1个工作日。
  3. 03Anthropic用较弱的Claude Sonnet 5模型在60小时内测试50多种方案,用约2400条训练样本成功提升了早期Claude Opus 4.8的对齐水平。
  4. 04北大校友翁荔重返OpenAI后研究“Harness Engineering”,即在模型的软件运行系统层面实现RSI,如改进工具调用、上下文管理、任务分配等。
  5. 05OpenAI CEO山姆·奥特曼、Anthropic CEO达里奥·阿莫代伊、xAI创始人马斯克等巨头罕见地公开呼吁为AI安全研究集体“降速”。
反方 / 局限
  • 文章承认RSI面临关键技术难题,如“灾难性遗忘”和“研究判断力”难以自动化,后者的核心在于提出从未被考虑过的问题,这仍依赖人类直觉。
  • 作者暗示头部公司既是技术推动者也是安全标准定义者,存在利益冲突;它们一边增加安全投入,一边继续扩大算力和模型规模,这种“左右横跳”策略本身即是其真实意图的体现。
12 分钟 · 5 卡片 · 10 资料
读原文 →

概念锚点

前置背景

平行视角

未来推演

延伸追问