可灵 O3
视频模型
概览
Kling 3.0-Omni 视频生成。支持文生视频与图生视频,可进行多镜头分镜(3-15 秒)。暂不支持原生音频生成。可选标准(720P)、专业(1080P)或 4K 画质。
可灵 O3
规格
- 类别
- 视频模型
- 输入
- 文本, 图像
- 输出
- 视频
- 价格
36-900
最多接受 2 张图像输入:首帧与尾帧(均可选)。
能力
- 生成
- 动画化
- 文生视频
- 图生视频
- 起始帧
- 结束帧
- 全能
常见问题
既然能让分镜动起来,就不必让创意只停留在纸上。YouArt 上的 Kling O3 可将文字提示词、首帧图像、尾帧图像或三者的组合转化为具有电影感的视频片段,并支持多镜头叙事。选择 3 至 15 秒的时长,以及 Standard、Pro 或 4K 输出,即可生成直观的视觉初稿,让导演、设计师或营销团队在投入完整制作前评估效果。
概览:Kling O3 能做什么
Kling O3 是 YouArt 上的视频模型,来自 Kuaishou 的 Kling AI 系列,支持文生视频、图生视频和首尾帧视频生成。它属于 Kling 3.0-Omni 这一代模型,专为需要多镜头分镜规划,以及精准控制片段开场和结尾构图的创作者而设计。输入文字描述,按需上传首帧和尾帧,再设置时长、画面比例和分辨率。请注意,该模型不支持原生音频生成,输出为无声视频片段。输出分辨率可选 Standard(720P)、Pro(1080P)或 4K。
| 功能 | 用途 |
|---|---|
| 支持多镜头分镜规划 | 规划并生成连贯的场景序列,用于构建更长的叙事结构。 |
| 首尾帧输入 | 同时定义开场和结尾构图,引导片段中的运动和叙事发展。 |
| 3–15 秒时长范围 | 用 3 秒测试一个紧凑的瞬间,或延长至 15 秒,呈现更完整的场景。 |
| 最高 4K 输出 | 根据工作流所需的画质,选择 Standard(720P)、Pro(1080P)或 4K 进行生成。 |
| Omni 生成模式 | Kling 3.0-Omni 架构在同一模型中同时支持文生视频和图生视频。 |
最佳使用场景
多镜头分镜规划
使用 Kling O3 为电影、广告或品牌视频生成一组连贯的场景片段。通过首尾帧定义每个场景的开场和结尾构图,编写提示词描述其间的动作与镜头运动,再将每个片段分别生成为初稿。借助多镜头分镜规划支持,可以在确定完整制作日程前,先规划较长的叙事内容。
高分辨率产品与品牌视觉
对于需要 4K 画质视觉素材的营销团队,Kling O3 提供了从产品图像或品牌概念直接生成高分辨率视频初稿的方式。上传产品图像作为首帧,描述产品亮相方式和镜头运动,也可以设置展示品牌标志的尾帧。4K 输出选项可为创意总监提供高画质参考,用于营销活动评审。
建筑与设计可视化
对于建筑师、室内设计师和空间规划师,Kling O3 可将静态渲染图或设计概念转化为简短的漫游片段。提供入口或关键空间的首帧图像,描述镜头路径和光线,也可以设置尾帧来定义结尾构图。在委托制作完整动画之前,生成结果就能向客户或相关方传达空间氛围与游览顺序。
如何在 YouArt 上使用 Kling O3
可以直接在 YouArt 的模型界面使用 Kling O3。先准备一个能用一两句话描述的想法,再决定生成时需要首帧、尾帧、首尾帧,还是都不需要。实用的提示词应明确主体、可见动作、镜头运动和场景。
- 打开模型。前往 YouArt 的 Kling O3 页面,如果工作区提示需要登录,请先登录。
- 选择输入。输入文字提示词。可以上传首帧图像来确定开场构图,上传尾帧图像来定义结尾画面,也可以同时上传两者。
- 描述场景。明确画面中的动作、环境、氛围和镜头运动。请注意,该模型不生成音频,因此音频描述不适用。
- 设置格式。选择 16:9、9:16 或 1:1,将时长设为 3 至 15 秒,并选择 Standard、Pro 或 4K 输出。
- 生成并评估。生成初稿,评估运动和构图效果,再调整提示词或首尾帧,用于生成下一版。
输入与输出
Kling O3 接受文字提示词和最多两张图像输入,即首帧和尾帧,输出为无声视频片段。模型页面显示的设置支持适用于横屏、竖屏和方形内容发布的常用画幅。
| 规格 | 当前 YouArt 模型页面信息 |
|---|---|
| 输入方式 | 文字提示词;最多一张首帧图像;最多一张尾帧图像 |
| 生成模式 | 文生视频;图生视频;首尾帧插值 |
| 主要输出 | 无声视频(不支持原生音频生成) |
| 画面比例 | 16:9, 9:16, 1:1 |
| 时长范围 | 3–15 秒 |
| 分辨率选项 | Standard(720P)、Pro(1080P)、4K |
| 积分显示 | 页面所示设置需 80 积分;生成前请查看实时界面 |
提示词与使用示例
最实用的 Kling O3 提示词会描述观众看到的画面,以及镜头如何运动。如果已有首帧和尾帧,就让图像负责确定构图,用提示词指导两帧之间的动作和镜头运动。
示例 1:多镜头场景序列
输入:以黄昏时的城市街道图像作为首帧,以咖啡馆内部图像作为尾帧,并搭配文字。
提示词:镜头跟随一位人物,从繁忙的城市街道走进安静的咖啡馆。光线从室外温暖的琥珀色路灯过渡到咖啡馆内柔和的照明。镜头运动保持连贯,跟随人物穿过门口。
适用原因:两张图像定义场景的起点和终点。提示词指导其间的镜头运动与光线过渡,展示 Kling O3 的首尾帧模式如何支持多镜头叙事规划。
示例 2:4K 产品亮相
输入:以放置在深色台面上的奢华腕表图像作为首帧,并搭配文字。
提示词:镜头缓缓推近表盘,一束窄光扫过表盘,展现指针与表壳的质感。镜头运动精准而从容。
适用原因:首帧确定产品外观和开场构图,提示词指导镜头运动与光线变化。选择 4K 输出,可为营销团队提供用于营销活动评审的高分辨率初稿。
示例 3:建筑漫游
输入:以现代建筑入口图像作为首帧,以阳光照耀的室内中庭图像作为尾帧,并搭配文字。
提示词:镜头平稳穿过入口,进入明亮的中庭。晨光透过落地窗,在抛光石材地面上投下长长的影子。镜头沿直线路径从入口移动至空间中央。
适用原因:两张图像定义入口位置和目的地,提示词补充镜头路径和光线质感,为建筑师或设计师提供直观的空间游览序列,便于与客户共同评审。
使用技巧与限制
- 如果开场和结尾构图已确定,就同时使用首尾帧。模型会生成两帧之间的运动,因此每一帧越明确,输出结果就越可预期。
- 根据创意选择时长。3 秒适合紧凑的产品亮相;10–15 秒则能为镜头留出时间,穿行于空间之中或呈现更长的完整动作。
- 单独规划音频。Kling O3 不生成原生音频。如果需要同步声音,请在后期制作环节添加,或考虑支持音视频联合生成的 Kling v3.0。
- 使用多镜头分镜规划较长的叙事内容。将每个场景分别生成为独立片段,再在工作流的下一阶段组合选定的初稿。
- 编写提示词前先确定画幅。为 9:16 设计的产品特写,与具有电影感的 16:9 场景需要不同的取景方式。
- 限制:不支持原生音频。输出为无声视频片段,音频必须在单独的环节中添加。
对比与相关模型
YouArt 模型页面同时展示 Kling O3 和其他视频生成选项。可以根据已有输入,以及下一个场景所需的控制方式,参考下表选择合适的模型。
| 相关模型 | 适合改用该模型的情况 |
|---|---|
既需要同样的首尾帧控制,也需要原生音视频联合生成。 | |
需要让多个生成场景中的角色或物体与参考保持一致。 | |
希望只输入一张首帧图像,生成较短的 5–10 秒 Kling 视频片段,并带有原生音频。 | |
希望选择 ByteDance 的替代模型,支持 4–15 秒时长、1080p 和原生音频。 | |
希望选择 Alibaba 的替代模型,支持多镜头叙事和提示词扩展。 |
这款模型最适合以多镜头分镜规划和精准构图控制为优先需求,且可以在单独环节添加音频的文生视频或帧引导视频创意。如果想更全面地了解可选模型,可以返回 YouArt 的视频模型列表,在投入积分正式生成前,对比各模型页面显示的输入、设置和示例表现。
工作流中的应用
Kling O3 很适合用于视频制作工作流的规划阶段。它能将一句分镜描述、首尾帧参考或文字描述转化为高分辨率视觉初稿,供团队共同评审。使用AI 视频工作流构建器,可以组织从创意提示词到生成片段,再到后续创作步骤的衔接。
对于导演和设计师,Kling O3 可直接融入AI 分镜转视频工作流,让每个生成片段对应更大叙事序列中的一个场景段落。对于产品和品牌团队,如果首次评审就需要高分辨率视觉素材,4K 输出选项使其成为AI 功能发布视频生成器工作流的实用起点。
创作你的下一支视频
Kling O3 提供首尾帧控制和最高 4K 输出,让导演、设计师、产品营销人员及品牌团队能够直接测试多镜头分镜创意。准备好提示词、首帧图像、尾帧,或同时准备三者,选择适合场景的格式,就能将最初的想法转化为供团队评估的视觉初稿。