Estimativa de profundidade com IA para vídeo

Gerador de Mapa de Profundidade de Vídeo com IA: transforme qualquer clipe em um passe de profundidade

Envie um vídeo e receba um mapa de profundidade, um para cada quadro: mais claro é mais perto da câmera, mais escuro é mais longe. O movimento, o movimento de câmera, o enquadramento e o tempo permanecem; a cor e a textura não. É exatamente esse o ponto: isso entrega a um modelo de vídeo, a um compositor ou a uma ferramenta 3D a estrutura de um material real sem arrastar junto a aparência dele.

Saída

A escala de cinza é a única que as ferramentas seguintes conseguem ler. As rampas de cor são para visualizar.

8 créditos por segundo de vídeo

Até 100 MB por clipe

40 créditos

O vídeo de profundidade abre em uma sessão à qual você pode voltar, pronto para baixar ou levar para outra ferramenta.

Como funciona

Crie um mapa de profundidade em três passos

  1. Passo 1

    Envie seu vídeo

    Solte um MP4, MOV ou WebM de até 100 MB. A resolução e a taxa de quadros seguem o original, então nada é redimensionado nem reamostrado na entrada.

  2. Passo 2

    A profundidade é estimada quadro a quadro

    O modelo lê o clipe inteiro em vez de cada quadro isolado e grava a que distância da câmera está cada pixel. Como ele observa os quadros vizinhos, uma parede parada mantém a mesma profundidade em vez de oscilar de um quadro para o outro.

  3. Passo 3

    Gere e baixe

    O vídeo de profundidade abre em uma sessão à qual você pode voltar, então dá para baixar, processar o próximo clipe ou levar o resultado ao editor de fluxo de trabalho como entrada de controle para um modelo de vídeo.

Antes e depois

A mesma cena, escrita como distância

  • Dezenas de pessoas a dezenas de distâncias, cada uma separada da seguinte. Toda a faixa tonal está em uso, das figuras quase brancas na borda inferior ao preto no ponto de fuga.
  • Poucos elementos a distâncias muito diferentes, e a estrutura fina se mantém: as folhas separadas da planta são resolvidas, e o cômodo além da porta é corretamente lido como mais distante que a parede em volta.

Para que serve

Quando um modelo ou um compositor precisa de estrutura, não de pixels

Geração de vídeo guiada por profundidade

Entregue o passe de profundidade a um modelo de vídeo como entrada de controle e ele vai seguir o layout, o movimento de câmera e o tempo do seu material enquanto inventa uma aparência completamente diferente. A profundidade carrega a geometria sem carregar os rostos, as cores ou as texturas do original.

Composição e correção de cor

Um passe de profundidade comanda profundidade de campo, névoa atmosférica, fumaça e reiluminação no After Effects, Nuke, Fusion ou Resolve. É a máscara que você teria de rotoscopar à mão, e ela se atualiza sozinha conforme a cena se move.

3D, vídeo espacial e paralaxe

Desloque um plano pelo mapa de profundidade e um clipe chapado ganha paralaxe de verdade: o movimento de câmera 2.5D, uma conversão para vídeo espacial, um passe de estéreo oscilante. A profundidade é o único canal de que todos esses efeitos precisam e que nenhuma câmera registra.

Separar o perto do longe

Como a profundidade é contínua e não um recorte duro, você pode colocar o limiar onde quiser: isolar o elemento em primeiro plano, remover só o fundo ou tratar a cor da distância média sozinha, sem depender de chroma.

Como a estimativa funciona

Feito para vídeo, e é isso que o mantém estável

Ele lê os quadros em volta de cada quadro

Rodar um modelo de profundidade de imagem em um clipe quadro a quadro é o que faz a profundidade ferver: cada quadro faz seu próprio palpite independente, os palpites divergem um pouco, e por isso superfícies planas rastejam e as bordas vibram. Um modelo de profundidade de vídeo lê os quadros vizinhos em conjunto, então uma superfície parada mantém o mesmo valor e o passe continua utilizável na edição.

Profundidade relativa, não em metros

A saída é relativa: ela diz o que está mais perto e o que está mais longe dentro de uma cena, não a que distância real algo está, e a escala é reajustada a cada clipe. É exatamente disso que ControlNet, deslocamento e profundidade de campo precisam. Não é o que uma ferramenta de medição quer, e nenhum modelo de câmera única consegue entregar isso.

Cinza para trabalhar, cor para olhar

A escala de cinza é o formato de intercâmbio: toda ferramenta que consome um mapa de profundidade lê o brilho, então esse é o padrão. As quatro rampas de cor — turbo, inferno, magma e viridis — espalham os mesmos valores por uma faixa de matizes, o que torna a ordem de profundidade bem mais fácil de ler na tela, mas precisam ser convertidas de volta antes que qualquer etapa seguinte consiga usá-las.

Pague por segundo, não por mês

Todos os planos incluem créditos que você pode gastar nesta página ou em qualquer outra parte da YouArt, e uma conta nova começa com créditos de teste gratuitos.

Básico

Para entusiastas e exploradores

$9.99/mês
Selecionar plano
  • 1000 Créditos
  • Até ~200 imagens/mês
  • Pelo menos ~1000s de vídeo/mês
  • Agente criativo inteligente
  • Editor de vídeo
  • Modelos de imagem mais recentes, incluindo GPT Image 2 e Nano Banana Pro
  • Modelos de vídeo mais recentes, incluindo Seedance 2
  • Envio de fotos de rostos reais
  • Geração de voz com ElevenLabs
  • Sem marca-d'água
  • Acesso ilimitado a modelos

Pro

Mais popular

Para criadores e usuários profissionais

$29.99/mês
Selecionar plano
  • 3300 Créditos
  • Até ~1000 imagens/mês
  • Pelo menos ~3300s de vídeo/mês
  • Agente criativo inteligente
  • Editor de vídeo
  • Modelos de imagem mais recentes, incluindo GPT Image 2 e Nano Banana Pro
  • Modelos de vídeo mais recentes, incluindo Seedance 2
  • Envio de fotos de rostos reais
  • Geração de voz com ElevenLabs
  • Sem marca-d'água
  • Acesso ilimitado a modelos

Max

Para usuários avançados e equipes

$149.99/mês
Selecionar plano
  • 18000 Créditos
  • Até ~6000 imagens/mês
  • Pelo menos ~18000s de vídeo/mês
  • Agente criativo inteligente
  • Editor de vídeo
  • Modelos de imagem mais recentes, incluindo GPT Image 2 e Nano Banana Pro
  • Modelos de vídeo mais recentes, incluindo Seedance 2
  • Envio de fotos de rostos reais
  • Geração de voz com ElevenLabs
  • Sem marca-d'água
  • Acesso ilimitado a modelos

Equipe

Para equipes e estúdios

$329.99/mês
Selecionar plano
  • 36300 Créditos
  • Até ~12000 imagens/mês
  • Pelo menos ~36300s de vídeo/mês
  • Envio de fotos de rostos reais
  • Compartilhe canvas, fluxos de trabalho e recursos com sua equipe
  • Até 10 membros por equipe
  • Até 5 equipes
  • Gerenciamento por função
  • Gerenciamento de Créditos da equipe e limites de gastos
  • Monitoramento de uso por membro

Perguntas

Perguntas frequentes sobre mapa de profundidade de vídeo

O que é um mapa de profundidade de vídeo?
É um segundo vídeo com a mesma duração do seu, em que o brilho significa distância: quanto mais claro o pixel, mais perto da câmera aquele ponto está. Ele mantém o movimento, o movimento de câmera, o enquadramento e o tempo do original e descarta a cor e a textura, e é isso que o torna útil como entrada para outra coisa em vez de algo para assistir.
Por que não rodar um modelo de profundidade de imagem em cada quadro?
Dá para fazer isso, e o resultado normalmente treme. Cada quadro é estimado de forma independente, então uma parede que nunca se move recebe uma profundidade ligeiramente diferente em cada quadro e parece rastejar ou ferver. Este modelo lê os quadros em volta de cada quadro, então a geometria estática fica parada. Essa estabilidade temporal é a razão inteira de existir um modelo de profundidade específico para vídeo.
Isso é profundidade métrica? Dá para medir distâncias com ela?
Não. É profundidade relativa: ela ordena o que está mais perto e mais longe dentro de uma cena, e a escala é ajustada por clipe em vez de expressa em metros. É exatamente disso que precisam a geração guiada por profundidade, o deslocamento, a névoa e a profundidade de campo. Se você precisa de medidas reais, precisa de um sensor de profundidade ou de um conjunto de câmeras calibrado, e nenhum modelo de vídeo único substitui isso.
Posso usar a saída para controlar um modelo de vídeo com IA?
Pode, e esse é o motivo mais comum para criar um. Um passe de profundidade entrega ao modelo de vídeo a geometria, o movimento de câmera e o tempo do seu material, deixando a aparência completamente aberta, então dá para reestilizar uma cena por completo e ainda manter a marcação dela. Use a saída em escala de cinza para isso: é o que as entradas de controle esperam.
Qual saída de cor eu devo escolher?
Escala de cinza, a menos que você vá apenas olhar. Tudo o que vem depois — uma entrada de controle, o canal de profundidade de um compositor, um modificador de deslocamento — lê o brilho, então um arquivo em turbo ou viridis precisa ser convertido de volta antes de funcionar. As rampas de cor são de fato melhores para julgar profundidade a olho, o que as torna úteis para revisão e apresentação.
Quanto custa e dá para testar de graça?
A cobrança é pela duração do clipe, a 8 créditos por segundo: um vídeo de dez segundos custa 80 créditos e um minuto custa 480. Uma conta nova começa com créditos de teste gratuitos, então dá para processar um clipe curto e ver a saída antes de decidir.
O vídeo de profundidade mantém meu áudio?
Não. A saída é muda — um mapa de profundidade é dado de imagem, e qualquer trilha sonora do original é descartada. Se o corte final precisar do áudio original, traga-o de volta no editor de vídeo junto com o passe de profundidade.
Quais arquivos de vídeo eu posso enviar?
MP4, MOV e WebM, até 100 MB por arquivo. A resolução e a taxa de quadros seguem o original em vez de serem forçadas a um preset, então o que sai bate quadro a quadro com o que entrou.

Mais ferramentas

Outras coisas para fazer com o mesmo arquivo

Cada uma faz um único trabalho em um arquivo que você já tem — sem prompt para escrever e sem editor para aprender.

Ver todas as 9 ferramentas de IA

Além de um passe

Quer usar a profundidade, não só baixá-la?

Esta página roda um único passo fixo. Abra o editor de fluxo de trabalho para ligar o passe de profundidade direto a um modelo de vídeo como entrada de controle, rodar um lote de clipes no mesmo grafo ou encadeá-lo depois de um upscale.