6.5
深览指数
科技智东西·茄子··AI 生成

10美元、两小时、5500行代码,卡帕西让Claude Opus 5搭出《指环王》3D世界

AI大神卡帕西用100万token预算,让Claude Opus 5将《指环王》开篇文字转化为可运行的Three.js 3D动画,耗时约2小时、生成约5500行代码、成本仅10美元。实验展示了大模型在长程复杂任务中的能力:理解文本、拆解场景、创建3D资产、编写动画代码并自我检查修正。但模型短板也很明显,无法连续观看视频或进入场景试玩,只能逐帧截图检查,导致多次出错。这一实验的价值不在于替代专业动画,而在于让按需生成的高度定制化世界成为可能,为评估大模型能力提供了新的测试范式。原文 ↗

核心观点
  • 大模型已经能够将一段文字转化为可运行的3D场景,但视觉审查和错误修复能力(质量闭环)仍未跟上代码生成能力,是当前主要瓶颈。
  • 10美元成本让过去投入产出比过低、几乎没人愿意制作的一次性定制化3D项目变得可行,可能催生按需生成的可探索世界。
  1. 01卡帕西用100万token预算,让Claude Opus 5花费约2小时、生成约5500行Three.js代码,成功将《指环王》开篇第一段文字渲染为可交互的3D场景,总成本约10美元。
  2. 02模型需要理解原文、拆解场景、创建多边形资产、确定三维坐标,并编写镜头、动作和时间线代码,最终交付的是可在浏览器中运行的Three.js程序。
  3. 03模型无法高效观看连续视频或进入场景试玩,只能缓慢截取不同时点的画面逐张检查,导致在检查和修改过程中数次出错。
  4. 04Three.js官方账号指出了优化建议(使用实例化网格),模型初版代码未主动采用这一常见优化——原版含1569次独立渲染调用,优化后仅需4次即可渲染1154个同类物体。
  5. 05配音由ElevenLabs生成,且由卡帕西手动选择声音,表明当前阶段人类在特定环节仍需介入。
反方 / 局限
  • 实验暴露了模型质量闭环的短板:生成能力已走在审查能力之前,模型无法确认最终结果在画面、空间和时间线上是否全部正确。
  • 卡帕西未披露输入、输出和工具调用分别消耗了多少token,100万token是预算而非实际消耗,实验的复现性和透明度有限。
  • 这一实验并非标准化评测,只是一个开放式案例,无法直接横向比较不同模型在同类任务上的表现。
9 分钟 · 4 卡片 · 7 资料
读原文 →

前置背景

平行视角

未来推演

延伸追问