科技虎嗅·科技导报©··AI 生成
当AI模型被按下暂停键
美国政府首次以国家安全指令,要求Anthropic暂停向外国公民提供Claude Fable 5和Mythos 5模型访问权限,标志着AI出口管制从芯片、算力延伸至模型层。文章深入剖析了争议焦点:模型“越狱”风险的真实性与量化难题、攻防同源的技术悖论,以及智能体框架带来的新威胁。与前两年单纯的技术封锁讨论不同,本文揭示了亚马逊作为投资方参与游说的企业竞争维度,并以中国视角分析了国产替代与安全治理同步推进的紧迫性。适合关注AI安全、中美科技竞争与出口管制政策的深度读者。原文 ↗原文 ↗
核心观点
- ▍美国对AI的出口管制正从芯片、算力扩展到模型访问权,Anthropic的案例是标志性事件,预示着未来AI治理将围绕“谁能用、用到什么程度、由谁决定风险”展开地缘政治博弈。
- 012026年6月12日,美国政府对Anthropic下达国家安全指令,限制Claude Fable 5和Mythos 5的访问,对象包括美国境外用户、身处美国的外国公民及Anthropic内部的外籍员工。
- 02Anthropic认为政府担忧的“越狱”风险案例仅涉及少量已知低级别漏洞,其他公开模型同样能发现,Fable 5不构成特殊风险。
- 03Axios等媒体报道,亚马逊曾向美国政府表达对Fable 5/Mythos安全风险的担忧,暗示模型安全争议已延伸到企业竞争与行业话语权之争。
- 04复旦大学张晓寒指出,大模型在代码解析、漏洞研判上具有攻防通用性,攻击者可通过拆解任务、分步提问绕过限制,使风险评估需考虑连续任务能力而非单次输出。
- 05复旦大学戴嘉润团队监测发现,智能体框架使模型能调用工具、访问系统,前沿模型即使配备简单智能体框架,也可能对真实软件系统发起自主攻击,治理对象应包括模型、工具、权限和运行环境。
反方 / 局限
- — 访问限制虽可减少低门槛攻击者批量获得漏洞利用能力,但合规研究人员、中小企业安全团队和开源项目维护者可能因此失去先进模型帮助,反而削弱漏洞发现和修复能力,拉大攻防差距。
- — 现有模型限制规则混合了安全判断和地缘政治诉求,其科学性、公平性存疑,真正的安全问题不应与商业竞争、技术封锁混为一谈。
概念锚点
前置背景
平行视角
未来推演
延伸追问