可灵 v3.0
视频模型
概览
最新可灵视频生成模型,具备原生音视频同步生成功能。可创建与电影级视觉效果同步的音效和环境音。支持 3-15 秒灵活时长,提供 16:9、9:16、1:1 宽高比,以及标准(720P)、专业(1080P)或 4K 输出。可接受提示词、首帧和尾帧输入。
可灵 v3.0
规格
- 类别
- 视频模型
- 输入
- 文本, 图像
- 输出
- 视频
- 价格
36-900
最多接受 2 个图像输入:首帧和尾帧。
能力
- 生成
- 动画化
- 文生视频
- 图生视频
- 起始帧
- 结束帧
- 音频
常见问题
不必让制作进度停在寻找配乐、协调素材和统一团队视觉方向上。YouArt 上的 Kling v3.0 可将文本提示词、首帧图像或成对的首尾帧转化为电影质感视频,并配上同步的音效和环境音频。将时长设为 3 至 15 秒,选择画布以及 Standard、Pro 或 4K 输出,即可获得首版成片。在投入周期更长的制作之前,先用这份具体的音视频草稿评估创意。
概览:Kling v3.0 能做什么
Kling v3.0 是 YouArt 上的视频模型,支持文生视频、图生视频和首尾帧视频生成。对于希望在投入完整制作流程之前,先看到场景动起来并听到声音的创作者,它提供了实用的预览方式。输入文本描述,按需上传首帧和尾帧,再在浏览器中设置时长、宽高比和分辨率。模型的原生音视频联合生成功能会在生成画面的同时生成旁白、音效和环境声,无需另行添加。最终可获得最高 4K 分辨率的音视频草稿,直接用于审阅。
| 功能 | 能帮助你做什么 |
|---|---|
| 原生音视频联合生成 | 从一份已包含同步旁白、音效和环境声的草稿开始创作。 |
| 首尾帧输入 | 同时定义开场和结尾构图,引导短片的运动过程与叙事走向。 |
| 3–15 秒时长范围 | 可以用紧凑的 3 秒片段测试产品展示瞬间,也可以延长至 15 秒,呈现更完整的场景。 |
| 最高 4K 输出 | 根据工作流对画质的要求,选择 Standard(720P)、Pro(1080P)或 4K 生成。 |
| 灵活的宽高比 | 为同一创意选择 16:9 横屏、9:16 竖屏或 1:1 方形构图,适配不同发布形式。 |
推荐使用场景
产品发布短片
使用 Kling v3.0,让产品图像动起来,呈现简短的发布亮相瞬间。上传产品图像作为首帧,描述产品亮相的方式,以及赋予产品真实质感的声音;还可以设置展示品牌标识或最终构图的尾帧。这样,营销团队便能在筹备更大规模的拍摄之前,获得用于产品页面、营销活动评审或社交平台付费广告不同版本的早期音视频创意方案。
电影质感分镜场景
Kling v3.0 是将文字场景转化为动态分镜参考的实用工具。导演或设计师可以描述构图、镜头穿行空间的方式以及预期氛围,先评估草稿,再委托开展更精细的制作。首尾帧模式在这里尤其有用:定义开场和结尾镜头,让模型生成两者之间的运动过程。
建筑与空间可视化
对于建筑师和室内设计师,Kling v3.0 可将静态渲染图或设计概念转化为简短的漫游视频。提供入口或关键空间的首帧,描述镜头路径和环境声,即可在委托制作完整动画之前,生成向客户或相关方传达空间氛围的短片。
如何在 YouArt 上使用 Kling v3.0
可以直接在 YouArt 模型界面使用 Kling v3.0。先准备一个能用一两句话描述的创意,再决定生成时需要首帧、尾帧、首尾帧,还是都不需要。实用的提示词应说明主体、可见动作、镜头运动方式、场景,以及场景中应有的音频。
- 打开模型。进入 YouArt 上的 Kling v3.0 页面,如果工作区提示需要登录,请先登录。
- 选择输入。输入文本提示词。可以按需上传首帧图像来确定开场构图,上传尾帧图像来定义结尾镜头,或同时上传两者。
- 描述场景。明确画面中的动作、场景、氛围、镜头运动,以及希望生成时考虑的旁白、音效或环境声。
- 设置格式。选择 16:9、9:16 或 1:1,将时长设为 3 至 15 秒,再选择 Standard、Pro 或 4K 输出。
- 生成并审阅。生成草稿,检查画面与音频的配合,再优化提示词或首尾帧,制作下一版。
输入与输出
Kling v3.0 接受文本提示词和最多两张图像输入:一张首帧和一张尾帧。输出为包含同步音频元素的视频。界面中显示的模型设置支持横屏、竖屏和方形发布常用的画布比例。
| 规格 | 当前 YouArt 模型页面信息 |
|---|---|
| 输入模式 | 文本提示词;最多一张首帧图像;最多一张尾帧图像 |
| 生成模式 | 文生视频;图生视频;首尾帧插值 |
| 主要输出 | 包含同步旁白、音效和环境声的视频 |
| 宽高比 | 16:9, 9:16, 1:1 |
| 时长范围 | 3–15 秒 |
| 分辨率选项 | Standard(720P)、Pro(1080P)、4K |
| 积分显示 | 所示设置下为 80 积分;生成前请查看实时界面 |
提示词与使用示例
最实用的 Kling v3.0 提示词会同时描述观众看到的画面和听到的声音。如果已有首帧和尾帧,可以让图像负责构图,用提示词指导两者之间的动作、镜头运动和音频。
示例 1:使用首尾帧呈现产品亮相
输入:首帧图像为大理石台面上的护肤品瓶,尾帧图像为纯净白色背景上的品牌标志,并配以文本。
提示词:镜头缓缓环绕护肤品瓶,柔和的影棚灯光映出玻璃质感。瓶身旋转时响起轻柔的铃音,随后是干净、简约的环境音。镜头平缓推进至标签特写,再过渡到结尾的品牌标识。
适用原因:两张图像分别定义开场的产品镜头和结尾的品牌展示。提示词补充镜头路径、光线变化和声音提示,将它们串联成连贯的发布短片。
示例 2:吸引注意的竖屏社交视频开场
输入:文本提示词。
提示词:在 9:16 画面中,一位厨师正在光线昏暗的餐厅厨房里摆盘。镜头保持固定,蒸汽从盘中升起。煎锅的滋滋声、勺子的轻碰声和厨房低沉的背景嗡鸣声充满整个场景。
适用原因:提示词将动作聚焦于单个瞬间,说明镜头运动方式,并明确声音环境。竖屏画布与计划投放的社交视频版位相匹配。
示例 3:建筑漫游
输入:玻璃建筑入口的首帧图像,并配以文本。
提示词:镜头缓缓穿过入口,进入阳光充盈的中庭。晨光透过落地窗,在抛光混凝土地面上投下长长的影子。克制的氛围配乐和轻微的脚步声伴随镜头移动。
适用原因:首帧确定了进入空间的位置和建筑风格。提示词引导镜头路径、光线质感和声音,向客户或设计团队传达空间氛围。
技巧与限制
- 如果开场和结尾构图已确定,就同时使用首尾帧。模型会生成两者之间的运动过程,因此每帧越明确,输出就越可预期。
- 让时长与创意相匹配。3 秒适合紧凑的产品亮相;10–15 秒则为镜头穿行空间或完成较长动作留出余地。
- 用直白的语言指导音频。明确能烘托场景的旁白、音效或环境声,再检查它们是否契合画面节奏。
- 先选画布,再写提示词。为 9:16 设计的产品特写,与电影质感的 16:9 发布短片需要不同的构图。
- 将较长的故事拆分成场景。分别创建短片段,对比草稿,再在工作流的下一阶段将选中的片段组合起来。
- 限制:模型最多接受两张图像输入。如果复杂的多镜头控制需要首尾帧之外的更多图像,请将整个序列拆分为多次生成来规划。
对比与相关模型
YouArt 模型页面同时展示 Kling v3.0 和其他视频生成选项。下表可作为选择指南:根据手头已有的输入素材,以及下一个场景所需的控制方式来选择模型。
| 相关模型 | 以下情况可改选此模型 |
|---|---|
需要最新的 Kling 系列,以及增强的运动控制和参考图像能力。 | |
希望用单张首帧输入生成较短的 5–10 秒短片,并带有原生音频。 | |
希望选择由 ByteDance 提供的备选模型,支持 4–15 秒时长、1080p 输出和原生音频。 | |
需要基于单张参考图像生成 720p 视频,并具备较强的时序一致性和运动理解能力。 | |
希望选择由 MiniMax 提供的备选模型,侧重文生视频,并具备出色的运动表现。 |
这款模型主要适合通过提示词或图像帧引导的视频创意生成,提供原生音视频联合生成功能和灵活的分辨率选择。若想更全面地了解可用选项,可以返回 YouArt 的视频模型页面,对比各模型展示的输入、设置和示例表现,再决定是否投入积分进行正式制作。
工作流中的应用
Kling v3.0 可用于创意工作流的前期:将产品概念、一句分镜描述或首尾帧参考转化为简短的音视频草稿,供团队共同审阅。借助AI 视频工作流构建器,可以在需要时梳理从创意提示词到生成短片,再到下一创作环节的衔接。
对于产品营销,实用的流程是:确定受众和渠道,选择最合适的宽高比,使用图生视频产品营销工作流生成一个目标明确的场景,再以最佳草稿为基础进行迭代。对于导演和设计师,Kling v3.0 可以自然融入AI 分镜转视频工作流,让每段生成的短片对应更大序列中的一个场景节拍。
创作你的下一支视频
Kling v3.0 为产品营销人员、导演、设计师和社交内容创作者提供了直接测试场景的方式,支持原生音视频联合生成和最高 4K 输出。准备好提示词、首帧图像、尾帧,或将三者一并提供,选择适合渠道的格式,就能把最初的创意变成团队可看、可听的草稿。