7.4
深览指数
科技虎嗅·硅星人··AI 生成

实测MiniMax H3 VS Seedance2.5 :旗鼓相当,性格迥异

本文对同日上线的 MiniMax H3 和字节 Seedance 2.5 两款视频生成模型进行了多轮同题实测,包括复杂指令跟随、长镜头叙事、广告片制作及机器人训练数据生成。结论是两者能力旗鼓相当但风格迥异:H3 更擅长营造电影质感和保持空间连续性,但对精确指令执行有「少做」倾向;Seedance 2.5 更擅长精确执行指定运镜和动作,但容易出错(如穿模、场景不一致)。文章还指出 H3 将开源且价格更低,而 Seedance 2.5 延续闭源路线,为创作者提供了两种不同取舍的顶级选择。适合关注 AI 视频生成技术进展、模型选型及产品差异的创作者或技术决策者阅读。原文 ↗

核心观点
  • MiniMax H3 和 Seedance 2.5 能力旗鼓相当,但解决的是不同层次的问题:H3 更懂最终成片「应该像什么」,Seedance 2.5 更懂指令「要求它做什么」。
  1. 01在「博物馆奇幻短片」测试中,H3 漏掉了蓝鲸骨架俯冲和侧面跟拍,但守住了「一镜到底」、空间连续性和角色一致性;Seedance 2.5 完成了多数指定运镜,但通过切镜绕开「一镜到底」要求,且结尾场景出现石柱消失等错误。
  2. 02在「饮料广告片」测试中,H3 生成的画面更具广告质感,但舞者动作执行不精确,且结尾镜头未对准指定产品;Seedance 2.5 画面质感稍逊,但更准确地完成了二维到三维的转化,并正确执行了「Ending 镜头推向右侧产品」的指令。
  3. 03在「四机位机器人训练数据」测试中,两款模型均失败:H3 生成的四个画面视角相同,Seedance 2.5 虽有视角差异,但动作与指令要求不符,表明通用视频模型距离可靠模拟物理世界还有很大差距。
  4. 04H3 在 500 字超长提示词「东京街头」测试中,正确还原了玻璃弹珠上的「Moon 24」文字细节,展现了丰富的细节呈现能力,但存在镜头未按指定路线运动、道具手部顺序错误等问题。
  5. 05Seedance 2.5 在 30 秒长片段「犯罪动作片」测试中,完成了大部分指定运镜和动作,声音设计到位,但最终画面出现重大穿帮——远洋货船出现在了水泥地上。
  6. 06H3 官方 2K 定价为 0.8 元/秒,并宣布即将开放权重;Seedance 2.5 延续闭源路线,其上一代 2.0 版本 720P 定价接近 1 元/秒,1080P 超过 2 元/秒。
反方 / 局限
  • 文章指出,当任务复杂到无法完全完成时,H3 的典型错误是「少做」(漏掉指令),而 Seedance 2.5 的典型错误是「做错」(执行了但不符合物理规则或上下文),两者各有其局限性。
  • 在四机位机器人训练数据测试中,两者均失败,表明当前通用视频模型在处理需要严格物理一致性和多视角同步的任务时,能力严重不足。
20 分钟 · 3 卡片 · 9 资料
读原文 →

前置背景

平行视角

延伸追问