5.6
深览指数
科技TechCrunch·Russell Brandom··AI 生成
Anthropic 发布 Opus 5
Anthropic 发布了其旗舰模型 Opus 5,该模型在多项基准测试中超越了此前发布的 Fable 5,同时价格更低、限制更少。文章重点介绍了 Opus 5 在自我验证和迭代能力上的提升,以及其相对宽松的安全策略,包括豁免 30 天数据保留政策和较低的安全分类器触发率。此外,Anthropic 还推出了“自动回退”功能,以降低安全机制对 API 用户正常工作的干扰。适合关注 AI 模型演进、大模型竞争格局及安全策略差异的读者。原文 ↗
核心观点
- ▍Anthropic 新发布的 Opus 5 模型在多项基准测试中性能优于其更强大的旗舰模型 Fable 5,且价格更低、限制更少,可能在大多数使用场景中成为更优选。
- 01Opus 5 在发布公告中的多项基准测试上实际表现优于 Fable 5。
- 02Opus 5 在自我验证和迭代能力上显著增强,例如能根据不完整的提示自主编写计算机视觉管道。
- 03与 Fable 和 Mythos 不同,Opus 5 不受 30 天数据保留政策的约束,隐私限制更少。
- 04Opus 5 的安全分类器触发频率预计比 Fable 5 低 85%,表明对其采取了更宽松的监管策略。
- 05Anthropic 推出了“自动回退”功能,当安全分类器触发时,API 请求会自动路由到能力较弱的模型以返回有效响应,而非报错。
- 06Opus 5 在网络安全任务中仍有实质性限制,如禁止对软件二进制文件进行漏洞扫描,但允许对源代码进行漏洞搜索。
反方 / 局限
- — 文章未提及 Opus 5 在哪些关键基准测试中不如 Fable 5,也未讨论其性能优势是否源于更窄的适用范围或更低的复杂度。
6 分钟 · 3 卡片 · 9 资料
读原文 →