5.2
深览指数
产品Bestblogs·字节跳动Seed··AI 生成

一镜成片,随心参考|Seedance 2.5 正式发布

字节跳动 Seed 团队发布了 Seedance 2.5 视频生成模型,核心升级是单次可生成 30 秒高质量长视频片段,并支持多轮延长以保持叙事连贯性。模型能接受最多 30 张图片、10 段视频和 10 段音频作为多模态输入参考,显著增强了用户对构图、角色和风格的精准控制。文章详细展示了新功能在长叙事、多角色互动和绿幕编辑等场景下的应用,并坦白承认在物理规律表现和极多主体交互方面仍有明显局限,是一篇典型的“自家产品”功能通告,信息具体但缺乏外部视角和深度分析。原文 ↗

核心观点
  • Seedance 2.5 的核心竞争力在于将单次视频生成时长提升至 30 秒并支持多轮延长,同时大幅增强多模态参考能力,这使其在影视、广告等专业场景中更具实用性和生产力。
  1. 01单次生成时长从 Seedance 2.0 的版本提升至 30 秒,且支持多轮延长,生成后的片段可自然衔接,保持主体、场景和叙事节奏一致。
  2. 02模型一次可接受最多 30 张图片、10 段视频和 10 段音频作为多模态参考输入,用于融合构图、风格、人物等信息。
  3. 03增强了时间戳精准编辑功能,用户可通过 prompt 精确指定时间段的故事和画面,并对生成后的指定片段进行定向修改。
  4. 04新增了绿幕编辑、视角与运镜编辑、参考编辑等多种编辑能力,提升了模型的可控性。
  5. 05文章中通过多个展示案例,如“长发女孩酿酒”和“AB 主角对话”,展示了模型在长叙事、多角色互动及复杂场景下的表现。
反方 / 局限
  • 文章承认,模型在物理合理性(如重力、碰撞)和极多主体(如篮球赛中的多人)交互方面仍有提升空间,存在不符合物理规律或失真的情况。
  • 种子用户反馈,模型在复杂场景中的角色一致性、动作连贯性以及对复杂 prompt 指令的遵循度仍未达到完美,需要多轮尝试。
  • 作为一篇产品发布通告,文章缺少与行业竞品(如 OpenAI Sora、Meta Emu Video)的横向对比,也未提及模型参数量、训练数据、推理成本等关键性能指标。
3 分钟 · 3 卡片 · 9 资料
读原文 →

平行视角

未来推演

延伸追问