深度引导的视频生成
把深度通道作为控制输入交给视频模型,它会沿用你素材的布局、运镜和节奏,同时生成完全不同的外观。深度只传递几何结构,不会把原片的人脸、颜色和纹理一起带过去。
面向视频的 AI 深度估计
上传一段视频,得到逐帧的深度图:越亮离镜头越近,越暗越远。运动、运镜、构图和时间轴全部保留,颜色和纹理则被剥离。这正是它的用处——把真实素材的空间结构交给视频模型、合成软件或三维工具,而不把原片的外观一起带过去。
每秒视频 8 积分
单个文件最大 100 MB
深度视频会在一个可以随时回来的会话中打开,方便下载或接入其他工具。
使用方式
拖入 MP4、MOV 或 WebM,单个文件最大 100 MB。分辨率与帧率跟随原片,上传过程中不会被缩放或重采样。
模型会读取整段片子而不是孤立的单帧,算出每个像素离镜头多远。因为参考了相邻帧,静止的墙面会保持同一个深度值,不会逐帧漂移。
深度视频会在一个可以随时回来的会话中打开,你可以下载它、处理下一段素材,或把结果带进工作流编辑器,作为视频模型的控制输入。
处理前后对比
适用场景
把深度通道作为控制输入交给视频模型,它会沿用你素材的布局、运镜和节奏,同时生成完全不同的外观。深度只传递几何结构,不会把原片的人脸、颜色和纹理一起带过去。
深度通道可以驱动景深、大气雾、体积雾和重新布光,适用于 After Effects、Nuke、Fusion 和达芬奇。它相当于你本来要手动逐帧抠出来的遮罩,而且会随镜头运动自动更新。
用深度图对平面做位移,平面素材就有了真实视差——2.5D 运镜、空间视频转换、摇摆立体。这些效果都需要深度这一个通道,而普通摄像机并不会记录它。
深度是连续值而不是硬边抠像,因此可以在任意位置设阈值:单独取出前景主体、只替换背景,或者只对中景调色,完全不依赖颜色来做键控。
原理说明
把图像深度模型逐帧套在视频上,深度就会「沸腾」:每帧各猜各的,猜测之间略有出入,于是平面开始蠕动、边缘出现噪点。视频深度模型会把相邻帧放在一起读,静止的表面因此保持同一个数值,这条通道拿到剪辑里才真正可用。
输出的是相对深度:它告诉你同一个镜头里什么更近、什么更远,而不是任何东西的真实距离,而且每段片子的尺度都会重新拟合。ControlNet、位移贴图和景深要的正是这个。它不适合用来测量,单摄像头模型也给不出真实尺寸。
灰度是通用交换格式:所有消费深度图的工具读的都是亮度,所以默认就是灰度。turbo、inferno、magma 和 viridis 这四种彩色映射把同样的数值铺到色相上,肉眼判读深度层次会容易得多,但送进下游之前必须先转回灰度。
所有套餐都包含积分,可以用在这个页面或 YouArt 的任何其他功能上;新注册账号还会获得免费试用积分。
适合爱好者和探索者
适合专业人士
适合高级用户和团队
适合团队和工作室
常见问题
不止一条通道
这个页面只跑一个固定步骤。打开工作流编辑器,可以把深度通道直接接到视频模型的控制输入上、让一批片段跑同一张图,或者把它接在放大之后。