7.6
深览指数
科技虎嗅·AppSo··AI 生成
号称人类造的最后一个AI 要来了,刷屏全网的RSI 是什么
本文拆解了AI圈新热词RSI(递归自我改进)的含义、技术层级与产业博弈。文章指出,RSI的核心是让AI自主改进研发流程,以实现加速迭代,并介绍了从L1到L5的自主性分级。作者认为,当前关于RSI的末日安全叙事,本质上是头部公司争夺算力、资本和产业利益的工具,安全审查的高成本实际构成了扼杀竞争者的壁垒。适合对AI前沿技术概念与产业生态博弈感兴趣的深度读者。原文 ↗
核心观点
- ▍RSI(递归自我改进)是AI让AI设计更优下一代的学习和研发流程,一旦实现,AI将脱离人类工程师的控制,加速迭代直至“智能爆炸”。
- ▍当前围绕RSI的末日安全叙事,本质上是头部AI公司争夺算力、资本和产业利益的政治工具,安全审查的高门槛反而构成了它们的竞争护城河。
- 01上海交大、清华、字节跳动等机构研究者提出了RSI的L1至L5五级自主性模型,L5阶段AI能修改改进机制本身。
- 02OpenAI内部报告显示其“自动化研究实习生”系统在人类指导下可独立完成编码、实验、分析等任务,每投入1个人类工作日,智能体运行时长相当于3.1个工作日。
- 03Anthropic用较弱的Claude Sonnet 5模型在60小时内测试50多种方案,用约2400条训练样本成功提升了早期Claude Opus 4.8的对齐水平。
- 04北大校友翁荔重返OpenAI后研究“Harness Engineering”,即在模型的软件运行系统层面实现RSI,如改进工具调用、上下文管理、任务分配等。
- 05OpenAI CEO山姆·奥特曼、Anthropic CEO达里奥·阿莫代伊、xAI创始人马斯克等巨头罕见地公开呼吁为AI安全研究集体“降速”。
反方 / 局限
- — 文章承认RSI面临关键技术难题,如“灾难性遗忘”和“研究判断力”难以自动化,后者的核心在于提出从未被考虑过的问题,这仍依赖人类直觉。
- — 作者暗示头部公司既是技术推动者也是安全标准定义者,存在利益冲突;它们一边增加安全投入,一边继续扩大算力和模型规模,这种“左右横跳”策略本身即是其真实意图的体现。
JWSTRecursive Self Improvement (RSI)I.J. GoodJakub Pachocki达里奥·阿莫代伊黄仁勋约翰·舒尔曼 (John Schulman)翁荔 (Lilian Weng)Jacob Coxon埃文·休宾格 (Evan Hubinger)山姆·奥特曼马斯克 (Elon Musk)OpenAIAnthropic英伟达 (NVIDIA)上海交通大学清华大学字节跳动上海人工智能实验室The InformationxAIThinking MachinesGPT-6Jacob Coxon 辞职事件
12 分钟 · 5 卡片 · 10 资料
读原文 →