7.3
深览指数
科技TechCrunch·Russell Brandom··AI 生成

Anthropic 详述来自阿里巴巴、月之暗面和 DeepSeek 的蒸馏攻击

Anthropic 发布新报告,指控中国 AI 公司(阿里巴巴、月之暗面、DeepSeek)发起大规模模型蒸馏攻击,试图窃取其 Claude 模型的思维链能力。报告指出,攻击手法日趋复杂,涉及近2亿次交互,其中阿里巴巴被指发动了迄今为止最大规模的蒸馏行动,利用数万个账户批量提取训练数据。此事件反映出中美AI竞争已从芯片出口管制延伸至模型知识产权的攻防战,是继早前 OpenAI 类似指控后的新一轮升级。原文 ↗

核心观点
  • 中国 AI 公司发动的大规模模型蒸馏攻击已显著升级,攻击手法更复杂,规模远超此前报告,直接威胁美国前沿 AI 模型的核心能力。
  1. 01Anthropic 观察总计近2亿次与蒸馏攻击相关的交互,归因于5个独立的攻击活动。
  2. 02阿里巴巴的攻击活动规模最大,在2026年5月至7月间产生1.51亿次交互,峰值每天接近300万次,涉及3500个账户。
  3. 03攻击目标高度集中于 Claude 最有价值的能力:智能体及工具使用、编程与数据分析、逻辑推理。
  4. 04攻击者开发了欺骗模型暴露思维链的技巧,例如将查询伪装成将工作记忆翻译为片假名日语的翻译请求。
  5. 05来自月之暗面(Kimi 开发者)的攻击活动被指直接通过中国军队的路由器发出,其中一个请求要求 Claude 分析监控视频以判断目标行为是否异常。
  6. 06OpenAI 此前已报告类似活动,并特别指控 DeepSeek 从事蒸馏攻击。
反方 / 局限
  • Anthropic 未提供直接证据证明被“蒸馏”的训练数据已实际用于特定中国模型的训练,攻击归因主要基于共享的固定提示词和请求模式。
8 分钟 · 4 卡片 · 11 资料
读原文 →

前置背景

平行视角

未来推演

延伸追问