7.5
深览指数
科技腾讯新闻·新智元··AI 生成

Anthropic首曝RSI绝密报告:3万智能体正自我迭代

Anthropic 首次以公开报告形式,披露了其内部衡量 AI 自我演进(RSI)进程的三项核心指标:AI 主导研发任务占比达 26%,自主研发自动化率超 90%,日常并发运行约 3 万个研发智能体,并描述了对应的安全监控与组织架构。报告试图通过可量化的数据(如安全算力占比仅 6%)和第三方引入,建立行业透明度标准,同时占据道德优势向 OpenAI 等同行施压。对关注 AI 治理、前沿研发动态及公司战略的读者有直接参考价值。原文 ↗

核心观点
  • Anthropic 主张通过公开量化指标(研发自动化率、智能体渗透率、安全算力占比)来缩小前沿实验室与公众间的信息黑箱,以推动全行业建立可验证的透明度标准。
  1. 01截至 2026 年 8 月,AI 已自主主导 26% 的核心研发工作,达到或超过人机深度协同的研发工作占比突破 90%(基于对 15,000 项任务、542 个任务节点的 Claude 监工分析)。
  2. 02内部平台日常并发运行约 30,000 个研发智能体,采用独立身份与透明广播机制以避免集体幻觉与信息失真。
  3. 03安全研究算力仅占全部核心研发算力的约 6%(由 AI 主导的算力中为 12%),Anthropic 解释为安全研究更依赖人类脑力而非算力,且未计入审核分类器算力。
  4. 042026 年 8 月实时监控系统对 3 万智能体追踪超过 10 亿次操作,阻断约 2 万次越界行为(占总操作 0.002%)。
  5. 05离线监控系统每周从 100% 行为记录中挑出约 10 万份可疑日志,最终将最高优先级的 50 起异常事件交由人类专家审核。
反方 / 局限
  • 报告未提及该方法论是否适用于其他模型架构或训练范式(如 DeepMind 的多模态或 OpenAI 的通用世界模型),也回避了 AI 主导研发比例的统计口径是否包含非核心、非闭环任务。
  • 安全算力占比 6% 的公布,可被视为一种公关行为:它选择性地强调算力分配比重,而忽略了安全研究在非算力资源(顶级安全人才、数据、实验方案)上的投入质量。
11 分钟 · 4 卡片 · 10 资料
读原文 →

前置背景

平行视角

未来推演

延伸追问