YouArt

第 4 章(共 9 章)

视频生成:文生视频与图生视频

视频生成和其他一切都发生在同一块画布上:你创建一个视频节点,给它一个输入,再挑一个模型来运行。你喂给节点什么,决定了它是哪种模式——写一段描述就是文生视频,接一张已有的图就是图生视频。

挑选视频模型

不同模型擅长的方向不一样。在写提示词之前,先想清楚这个镜头真正需要什么——动作、质感、真实感、参考图,还是镜头语言——然后挑在那一项上最强的模型。

视频模型擅长方向一览。
模型擅长什么对应版本
海螺动作场面表现优秀。海螺 2.3
可灵细节与质感表现强;支持音画同步,也支持多模态参考。可灵 v3.0(音画同步)、可灵 O3 / 可灵 O3 参考(多模态参考)
Vidu动作表现均衡,支持文生/图生视频与运动控制(1-16 秒,最高 1080p)。Vidu Q3
Veo效果均衡,真实感强。Veo 3.1
Sora镜头语言丰富。Sora 2 / Sora 2 Pro(需开通 Sora 2 访问权限,否则不会出现在模型列表中)

文生视频(T2V)

文生视频只从一段描述开始,不需要原图。三步:

  1. 创建一个视频节点。
  2. 输入你的描述。
  3. 选择一个模型来生成。

图生视频(I2V)

图生视频从你已经有的画面开始。前两种是同一个视频节点上的两种接法;第三种通常要换成对应的「参考 / 全能参考」节点——Seedance 2.5 和 Wan v3.0 都明确规定首尾帧不能与参考素材在同一次生成里混用(可灵 O3 参考是例外,它可以同时接首尾帧和参考图)。

  • 单图 —— 从已有的图像节点上添加视频节点,把那张图作为首帧。
  • 双图(首尾帧) —— 适合明确镜头的起点与终点、控制运动轨迹、提升一致性。
  • 多参考素材视频 —— 换用「参考 / 全能参考」类节点(可灵 O3 参考、Seedance 2.5 全能参考、MiniMax H3 参考、Wan v3.0 全能参考),把人物、动作、声音带进画面;连接后在提示词里用 @Image1、@Video1、@Audio1 指明每个素材的作用。想在时间轴上钉关键帧,目前只有 FLUX 3 视频支持。

接下来

创作过程里你可能还会遇到一些很实际的小问题:角度不够合适、局部细节不满意、处理分镜效率低,或者视频有点糊。这些时候不用重写提示词再跑一遍模型——下一章讲的正是为这些情况准备的「即点即用」小工具。

常见问题

文生视频和图生视频有什么区别?

文生视频只从一段文字描述开始:你创建一个视频节点,输入描述,再选一个模型生成。图生视频从你已经有的画面开始——在已有的图像节点上添加视频节点,那张图就成为这段片子的首帧。

动作场面应该用哪个视频模型?

海螺在动作场面上被特别点出来,具体是海螺 2.3。Vidu Q3 是另一个选择,动作表现均衡,支持文生/图生视频与运动控制(若要多张参考素材,请改用 Seedance 2.5 全能参考或可灵 O3 参考)。如果你更在意细节和质感,可灵是更强的选择;Veo 3.1 则偏向效果均衡、真实感强。

怎么控制视频的开头和结尾?

用双图的方式,同时给出首帧和尾帧。它适合明确镜头的起点与终点、控制运动轨迹、提升一致性。如果画面需要更复杂的变化,改用「参考 / 全能参考」类节点(可灵 O3 参考、Seedance 2.5 全能参考、Wan v3.0 全能参考),把人物、动作、声音带进画面;想在时间轴上钉关键帧,目前只有 FLUX 3 视频支持。

Sora 能接参考图吗?真人素材有什么限制?

Sora 2 / Sora 2 Pro 支持接入 1 张参考图(图生视频模式),产品里并没有 Sora 专属的真人限制。真人素材的合规开关「真人合规模式」只出现在 Seedance 系列节点上(Seedance 2.0 / 2.0 全能参考 / 2.0 Mini / 2.5 / 2.5 全能参考 / 2.5 视频续写)。需要多张参考素材时改用可灵 O3 参考、Seedance 2.5 全能参考、MiniMax H3 参考或 Wan v3.0 全能参考。