7.3
深览指数
商业腾讯新闻·字母榜··AI 生成

通往AGI之路,字节要同时修两条

字节跳动正在押注一条极其激进的AI路线:同时推进5万亿参数大语言模型和基于Seedance的世界模型,由张一鸣亲自督战后者。文章详细披露了字节在语言基模落后于Fable、Astra等对手的背景下,试图利用抖音海量多模态数据优势和296亿美元融资,在LLM和世界模型两条赛道上“大力出奇迹”。核心矛盾在于:世界模型虽能复用字节内容生态与PICO硬件,但其训练成本是语言模型的10倍以上,商业化尚处萌芽期,而LLM追赶窗口正在收窄。适合关注AI产业战略、公司竞争格局的读者,了解字节此举的机遇与风险。原文 ↗

核心观点
  • 字节跳动在语言基模尚未达到SOTA的情况下,选择同时大力投入超大规模LLM和世界模型,这是一种尚未有公司尝试过的、极为冒险的“两手都要硬”战略。
  1. 01张一鸣正亲自督导基于Seedance的世界模型研发,该模型在20fps帧率下延迟约0.05秒,支持空间计算环境,计划于下月推出。
  2. 02字节AI一号位吴永辉为世界模型设下年底前性能比肩谷歌Genie 3的目标,并将其列为2026年四大命题之首,投入资金为文本、Coding、视频等方向中最高。
  3. 03字节以近三倍于2024年规模的296亿美元银团贷款为AI提供资金弹药,该贷款无抵押无质押,创中企境外融资最低利差。
  4. 04世界模型训练成本远高于语言模型。中金测算Sora训练算力成本理论约为GPT-4的10倍,而实时交互的世界模型成本更高。
  5. 05字节计划中的5万亿参数MoE模型,一次正式预训练计算量约9×10²⁵ FLOPs(GPT-4的4倍多),成本将远超GPT-4的1亿美元量级。
  6. 06字节的核心业务(抖音、PICO、直播)能为世界模型提供大量多模态数据、应用场景和种子用户,这是其语言模型不具备的优势。
  7. 07字节在语言模型领域相对落后,张一鸣承认‘Seed可以接受暂时的落后’,内部消息称豆包2.2推迟发布,目标是用更长周期换取编程、Agent能力提升。
反方 / 局限
  • 吴永辉多次在Seed内部会直言,字节世界模型和具身智能的效果不及预期,这或许是张一鸣亲自督战的直接原因。
  • 在外界AI巨头中,OpenAI和Anthropic专注语言模型,谷歌重心也已转向Gemini;只有字节一家在两个方向同时全力投入,缺乏先例验证。
  • 世界模型商业化路径尚不成熟,距离变现十分遥远,而语言模型已在B/C端形成成熟付费体系。双线作战将加剧财务压力,存在重蹈Meta元宇宙巨额亏损的风险。
11 分钟 · 1 卡片 · 2 资料
读原文 →

前置背景