科技微博·晚点LatePost··AI 生成
晚点独家丨字节想训超大参数模型,张一鸣:别被编程这种热点影响
字节跳动Seed团队计划训练参数规模超5万亿的模型,是目前国内已知最大规模。此前,其语言模型Seed 2.0市场反响有限,而多模态模型Seedance表现亮眼。张一鸣在内部会议上明确反对模型蒸馏,鼓励团队追求智能上限并做出有自身特色的模型,而非紧跟编程等短期热点。该决策被内部视为一场“赌博”,旨在通过“大力出奇迹”的方式在语言模型领域实现弯道超车。适合关注中国AI大模型竞争格局及公司战略的读者。原文 ↗原文 ↗
核心观点
- ▍字节跳动正计划训练参数规模超5万亿的模型,意图通过大幅提升参数规模,在语言模型领域实现对竞争对手的弯道超车,这被视为一场战略赌博。
- 01新模型规划参数超5万亿,超过阿里Qwen 3.8-Max(2.4万亿)和月之暗面K3(2.8万亿),为国内已知最大规模。
- 02Seed团队在语言模型上落后:其2月发布的Seed 2.0市场反响有限,而同期智谱GLM-5和月之暗面Kimi K3在Coding能力上已领先。
- 03多模态模型Seedance 2.0取得成功,成为全球性能最强的视频生成模型之一,并成为火山引擎MaaS业务的营收基本盘。
- 04火山引擎2025年收入约150亿元,2026年目标超400亿元;但豆包大模型token消耗中,超一半来自多模态模型,语言模型占比不高,且第二季度增长未达预期。
- 05张一鸣在Seed全员会上明确反对模型蒸馏,认为这只能复制Claude现有能力,无法实现真正超越。
- 06张一鸣认可编程(Coding)是当前关键方向,但提醒团队不应被热点完全牵着走,应探索编程之外的更大机会。
- 07字节跳动高层正在Seed内部推动取消赛马机制,收拢资源,并打破部门墙以促进协作。
反方 / 局限
- — 训练超大参数语言模型面临的挑战远超视频模型,包括系统工程、数据处理和跨部门深度协作,难度显著更大。
- — 该计划仍处于早期阶段,并不代表模型最终一定会发布,具有不确定性。
- — 内部人士将此策略形容为“一场赌博”,暗示其风险之高。
前置背景
平行视角
未来推演
延伸追问