7.1
深览指数
科技量子位·程浅··AI 生成
Claude Code之父:Harness保质期只有半年,解开缰绳吧
Claude Code 之父 Boris Cherny 在 YC 访谈中提出核心观点:AI 产品应主动删除系统提示词和工具代码,因为模型能力每半年就会跃升,旧指令反而成为束缚。他提出了「产品悬余」概念——模型能力总超出现有产品边界,以及「解缚」方法论——给模型更难的任务、让其自我验证、长时间独立运行。文章还强调与模型相处的经验主义态度:放弃预判,通过消融实验测试模型真实卡壳点。适合 AI 产品经理、模型应用开发者、AI 创业者阅读。原文 ↗
核心观点
- ▍AI 产品设计应每六个月主动删除系统提示词和工具代码,因为模型能力迭代快于产品,旧指令会变成束缚而不是帮助。
- ▍不要试图预判模型需要什么指令,而应通过消融实验——删除一行测试一行——来找到模型真正卡住的地方。
- 01Anthropic 在 Claude 5 上下文工程中删除了 Claude Code 超过 80% 的原有指令,Boris 称目前 harness 只保留安全、权限和静态分析部分。
- 02Boris 提出「产品悬余」概念:大模型以不连续跳跃式进化,产品以连续增量式集成,导致模型能力总会超出产品所能释放的边界,例如 2024 年底 Sonnet 3.5 已能写整个文件代码,但当时编程产品还在做补全。
- 03Anthropic 内部有人给 Opus 5 接入 OpenCV,模型能自己画出人物肖像和动物风景,此前从未训练过画画——这被视为「模型激发」的案例。
- 04Boris 本人让 Claude 将 Electron 应用重写成 Swift,在 Mac 虚拟机里逐像素对比截图,任务已运行超过两周,Claude 还自主建了 Slack 频道每隔几分钟发进度截图。
- 05Boris 认为当前最不足的是「让模型自我验证任务」——如果模型不能自我验证,就无法长时间独立运行。
- 06Boris 建议不要学 LinkedIn 网红和 Twitter 上的「奇技淫巧」,用经验主义方式对待模型,放下对旧模型的先验和「以前不行」的想法,愿意再试一次。
反方 / 局限
- — 文章提到一个未解答的归因问题:模型表现出的新能力究竟是「模型激发」出原本就具备的能力,还是因为脚手架设计而学会了新技能?
- — Boris 承认 Eval 的局限性:模型进化太快,很多评测会被很快刷到满分,需要设计新的 Eval 来观察模型反复挣扎的地方。
9 分钟 · 4 卡片 · 12 资料
读原文 →