Estimación de profundidad con IA para video

Generador de Mapas de Profundidad de Video con IA: convierte cualquier clip en un pase de profundidad

Sube un video y recibe un mapa de profundidad, uno por cada fotograma: más claro es más cerca de la cámara, más oscuro es más lejos. El movimiento, el recorrido de cámara, el encuadre y el tiempo se conservan; el color y la textura no. Ese es justamente el punto: le da a un modelo de video, a un compositor o a una herramienta 3D la estructura de material real sin arrastrar su apariencia.

Salida

La escala de grises es la única que leen todas las herramientas posteriores. Las rampas de color son para visualizar.

8 créditos por segundo de video

Hasta 100 MB por clip

40 créditos

El video de profundidad se abre en una sesión a la que puedes volver, listo para descargar o llevar a otra herramienta.

Cómo funciona

Crea un mapa de profundidad en tres pasos

  1. Paso 1

    Sube tu video

    Suelta un MP4, MOV o WebM de hasta 100 MB. La resolución y la velocidad de fotogramas siguen al original, así que nada se redimensiona ni se remuestrea al entrar.

  2. Paso 2

    La profundidad se calcula por fotograma

    El modelo lee el clip completo en lugar de cada fotograma por separado y escribe a qué distancia de la cámara está cada píxel. Como mira los fotogramas vecinos, una pared que no se mueve conserva la misma profundidad en lugar de desplazarse de un fotograma a otro.

  3. Paso 3

    Genera y descarga

    El video de profundidad se abre en una sesión a la que puedes volver, así que puedes descargarlo, procesar el siguiente clip o llevar el resultado al editor de flujo de trabajo como entrada de control para un modelo de video.

Antes y después

La misma toma, escrita como distancia

  • Decenas de personas a decenas de distancias, cada una separada de la siguiente. Se usa todo el rango tonal, desde las figuras casi blancas del borde inferior hasta el negro del punto de fuga.
  • Pocos sujetos a distancias muy distintas, y la estructura fina sobrevive: las hojas sueltas de la planta quedan resueltas, y la habitación del otro lado de la puerta se lee correctamente como más lejana que la pared que la rodea.

Para qué sirve

Cuando un modelo o un compositor necesita estructura, no píxeles

Generación de video guiada por profundidad

Entrega el pase de profundidad a un modelo de video como entrada de control y seguirá la disposición, el recorrido de cámara y el tiempo de tu material mientras inventa una apariencia completamente distinta. La profundidad transporta la geometría sin transportar los rostros, los colores ni las texturas del original.

Composición y etalonaje

Un pase de profundidad controla la profundidad de campo, la neblina atmosférica, la niebla y la reiluminación en After Effects, Nuke, Fusion o Resolve. Es la máscara que de otro modo tendrías que rotoscopiar a mano, y se actualiza sola conforme avanza la toma.

3D, video espacial y paralaje

Desplaza un plano según el mapa de profundidad y un clip plano gana paralaje real: el movimiento de cámara 2.5D, una conversión a video espacial, un pase estéreo oscilante. La profundidad es el único canal que todos esos efectos necesitan y que ninguna cámara registra.

Separar lo cercano de lo lejano

Como la profundidad es continua y no un recorte duro, puedes fijar el umbral donde quieras: aislar el sujeto en primer plano, quitar solo el fondo o etalonar la distancia media por separado sin recortar por color.

Cómo funciona la estimación

Hecho para video, que es lo que lo mantiene estable

Lee los fotogramas que rodean a cada fotograma

Aplicar un modelo de profundidad de imagen a un clip fotograma a fotograma es lo que hace que la profundidad hierva: cada fotograma hace su propia estimación independiente, las estimaciones difieren ligeramente y por eso las superficies planas se arrastran y los bordes vibran. Un modelo de profundidad de video lee los fotogramas vecinos en conjunto, así que una superficie que no se mueve mantiene el mismo valor y el pase sigue siendo utilizable en el montaje.

Profundidad relativa, no metros

La salida es relativa: te dice qué está más cerca y qué más lejos dentro de una toma, no a qué distancia real está algo, y la escala se reajusta en cada clip. Eso es justo lo que quieren ControlNet, el desplazamiento y la profundidad de campo. No es lo que quiere una herramienta de medición, y ningún modelo de una sola cámara puede darte eso.

Escala de grises para trabajar, color para mirar

La escala de grises es el formato de intercambio: toda herramienta que consume un mapa de profundidad lee el brillo, así que ese es el valor por defecto. Las cuatro rampas de color (turbo, inferno, magma y viridis) reparten los mismos valores en un rango de tonos, lo que hace mucho más fácil leer el orden de profundidad en pantalla, pero hay que convertirlas de vuelta antes de que algo posterior pueda usarlas.

Paga por segundo, no por mes

Todos los planes incluyen créditos que puedes gastar en esta página o en cualquier otra parte de YouArt, y una cuenta nueva empieza con créditos de prueba gratuitos.

Básico

Para aficionados y exploradores

$9.99/mes
Elegir plan
  • 1000 créditos
  • Hasta ~200 imágenes/mes
  • Al menos ~1000 s de video/mes
  • Agente creativo inteligente
  • Editor de video
  • Los modelos de imagen más recientes, incluidos GPT Image 2 y Nano Banana Pro
  • Los modelos de video más recientes, incluido Seedance 2
  • Carga de rostros realistas
  • Generación de voz con ElevenLabs
  • Sin marca de agua
  • Acceso ilimitado a plantillas

Pro

El más popular

Para creadores y usuarios profesionales

$29.99/mes
Elegir plan
  • 3300 créditos
  • Hasta ~1000 imágenes/mes
  • Al menos ~3300 s de video/mes
  • Agente creativo inteligente
  • Editor de video
  • Los modelos de imagen más recientes, incluidos GPT Image 2 y Nano Banana Pro
  • Los modelos de video más recientes, incluido Seedance 2
  • Carga de rostros realistas
  • Generación de voz con ElevenLabs
  • Sin marca de agua
  • Acceso ilimitado a plantillas

Max

Para usuarios avanzados y equipos

$149.99/mes
Elegir plan
  • 18000 créditos
  • Hasta ~6000 imágenes/mes
  • Al menos ~18000 s de video/mes
  • Agente creativo inteligente
  • Editor de video
  • Los modelos de imagen más recientes, incluidos GPT Image 2 y Nano Banana Pro
  • Los modelos de video más recientes, incluido Seedance 2
  • Carga de rostros realistas
  • Generación de voz con ElevenLabs
  • Sin marca de agua
  • Acceso ilimitado a plantillas

Equipo

Para equipos y estudios

$329.99/mes
Elegir plan
  • 36300 créditos
  • Hasta ~12000 imágenes/mes
  • Al menos ~36300 s de video/mes
  • Carga de rostros realistas
  • Comparte lienzos, flujos de trabajo y recursos con tu equipo
  • Hasta 10 miembros por equipo
  • Hasta 5 equipos
  • Gestión basada en roles
  • Gestión de créditos del equipo y límites de gasto
  • Seguimiento del uso por miembro

Preguntas

Preguntas frecuentes sobre mapas de profundidad de video

¿Qué es un mapa de profundidad de video?
Es un segundo video de la misma duración que el tuyo en el que el brillo significa distancia: cuanto más claro es un píxel, más cerca de la cámara está ese punto. Conserva el movimiento, el recorrido de cámara, el encuadre y el tiempo del original y descarta el color y la textura, que es lo que lo hace útil como entrada para otra cosa en lugar de como algo para ver.
¿Por qué no aplicar simplemente un modelo de profundidad de imagen a cada fotograma?
Puedes hacerlo, y el resultado suele parpadear. Cada fotograma se calcula de forma independiente, así que una pared que nunca se mueve recibe una profundidad ligeramente distinta en cada fotograma y parece arrastrarse o hervir. Este modelo lee los fotogramas que rodean a cada fotograma, así que la geometría estática se queda quieta. Esa estabilidad temporal es toda la razón por la que existe un modelo de profundidad específico para video.
¿Es profundidad métrica? ¿Puedo medir distancias con ella?
No. Es profundidad relativa: ordena qué está más cerca y más lejos dentro de una toma, y la escala se ajusta por clip en lugar de expresarse en metros. Eso es exactamente lo que necesitan la generación guiada por profundidad, el desplazamiento, la niebla y la profundidad de campo. Si necesitas mediciones reales necesitas un sensor de profundidad o un sistema multicámara calibrado, algo que ningún modelo de un solo video puede sustituir.
¿Puedo usar la salida para controlar un modelo de video con IA?
Sí, y es la razón más habitual para crear uno. Un pase de profundidad le entrega a un modelo de video la geometría, el recorrido de cámara y el tiempo de tu material dejando la apariencia completamente abierta, así que puedes cambiar por completo el estilo de una toma y conservar su puesta en escena. Usa la salida en escala de grises para esto: es lo que esperan las entradas de control.
¿Qué salida de color debería elegir?
Escala de grises, salvo que solo vayas a mirarla. Todo lo que viene después (una entrada de control, el canal de profundidad de un compositor, un modificador de desplazamiento) lee el brillo, así que un archivo en turbo o viridis hay que convertirlo de vuelta antes de que funcione. Las rampas de color son realmente mejores para juzgar la profundidad a ojo, lo que las hace útiles para revisión y presentación.
¿Cuánto cuesta y puedo probarlo gratis?
Se factura por la duración del clip, a 8 créditos por segundo: un video de diez segundos cuesta 80 créditos y un minuto cuesta 480. Una cuenta nueva empieza con créditos de prueba gratuitos, así que puedes procesar un clip corto y ver el resultado antes de decidir.
¿El video de profundidad conserva mi audio?
No. La salida es muda: un mapa de profundidad es información de imagen y cualquier banda sonora del original se descarta. Si tu montaje final necesita el audio original, vuelve a incorporarlo en el editor de video junto al pase de profundidad.
¿Qué archivos de video puedo subir?
MP4, MOV y WebM, hasta 100 MB por archivo. La resolución y la velocidad de fotogramas siguen al original en lugar de forzarse a un preajuste, así que lo que sale coincide fotograma a fotograma con lo que entró.

Más herramientas

Otras cosas que hacer con el mismo archivo

Cada una hace un único trabajo sobre un archivo que ya tienes: sin prompt que escribir y sin editor que aprender.

Ver las 9 herramientas de IA

Más allá de un solo pase

¿Quieres usar la profundidad, no solo descargarla?

Esta página ejecuta un único paso fijo. Abre el editor de flujo de trabajo para conectar el pase de profundidad directamente a un modelo de video como entrada de control, procesar un lote de clips con el mismo gráfico o encadenarlo después de un escalado.