Stima della profondità video con IA

Generatore di mappe di profondità video con IA: ricava un pass di profondità da qualsiasi clip

Trascina un video e ottieni una mappa di profondità per ogni fotogramma: le aree più chiare sono più vicine alla videocamera, quelle più scure più lontane.

Risultato

La scala di grigi è il formato letto da tutti gli strumenti nelle fasi successive. Le scale cromatiche servono solo per la visualizzazione.

8 crediti per secondo di video

Fino a 100 MB per clip

40 crediti

Il video di profondità si apre in una sessione che puoi riaprire quando vuoi, pronto da scaricare o usare in un altro strumento.

Clip originale
Mappa di profondità — il risultato di questo strumento
Un modello video guidato dalla mappa
Questa pagina genera solo la clip centrale. Usala come input di controllo per un modello video nell<editor>editor del flusso di lavoro</editor>: movimenti, inquadratura e tempi restano invariati, mentre tutto il resto viene sostituito.

Come funziona

Crea una mappa di profondità in tre passaggi

  1. Passaggio 1

    Carica il tuo video

    Trascina un file MP4, MOV o WebM fino a 100 MB. Risoluzione e frequenza dei fotogrammi restano quelle dell'originale, senza ridimensionamenti o ricampionamenti in ingresso.

  2. Passaggio 2

    La profondità viene stimata per ogni fotogramma

    Il modello analizza l'intera clip, anziché ogni fotogramma isolatamente, e calcola la distanza di ciascun pixel dalla videocamera. Poiché considera anche i fotogrammi vicini, una parete immobile mantiene la stessa profondità invece di cambiarla da un fotogramma all'altro.

  3. Passaggio 3

    Genera e scarica

    Il video di profondità si apre in una sessione che puoi riaprire quando vuoi. Puoi scaricarlo, elaborare la clip successiva o portare il risultato nell'editor del flusso di lavoro come input di controllo per un modello video.

Prima e dopo

La stessa ripresa, espressa in distanze

  • Decine di persone a decine di distanze diverse, ognuna distinta dalle altre. Viene usata l'intera gamma tonale, dalle figure quasi bianche sul bordo inferiore al nero del punto di fuga.
  • Pochi soggetti a distanze molto diverse, con tutti i dettagli più fini: le singole foglie della pianta restano distinguibili e la stanza oltre la porta risulta correttamente più lontana della parete che la circonda.
  • A distanza ravvicinata, il modello legge la FORMA, non solo la distanza: la tazza appare come un oggetto tondeggiante anziché una sagoma piatta e la scrivania sotto di essa si allontana con una gradazione uniforme.

A cosa serve

Quando un modello o uno strumento di compositing ha bisogno di struttura, non di pixel

Generazione video guidata dalla profondità

Usa la mappa di profondità come input di controllo per un modello video: seguirà la disposizione della scena, i movimenti di camera e i tempi del filmato, inventando un aspetto completamente diverso. La profondità trasmette la geometria senza portare con sé volti, colori o texture dell'originale.

Compositing e correzione colore

Una mappa di profondità permette di controllare profondità di campo, foschia, nebbia e modifiche all'illuminazione in After Effects, Nuke, Fusion o Resolve. È la maschera che altrimenti dovresti creare a mano con il rotoscoping, e si aggiorna da sola mentre la ripresa si muove.

3D, video spaziale e parallasse

Deforma un piano in base alla mappa di profondità e una clip piatta acquista una vera parallasse: un movimento di camera in 2,5D, una conversione in video spaziale o un effetto stereoscopico oscillante. La profondità è l'unico canale che serve a tutti questi effetti e che nessuna videocamera registra.

Separa ciò che è vicino da ciò che è lontano

La profondità è continua, non una sagoma dai bordi netti, quindi puoi impostare una soglia in qualsiasi punto: isola il soggetto in primo piano, elimina solo lo sfondo o correggi il colore del piano intermedio senza selezionarlo in base al colore.

Come funziona la stima

Progettato per i video, per una profondità stabile

Analizza ogni fotogramma insieme a quelli vicini

Applicare un modello di profondità per immagini a una clip, fotogramma per fotogramma, produce oscillazioni: ogni fotogramma riceve una stima indipendente e le stime differiscono leggermente, facendo ondeggiare le superfici piatte e tremolare i bordi. Un modello di profondità per video analizza insieme i fotogrammi vicini, così una superficie immobile mantiene lo stesso valore e la mappa resta utilizzabile nel montaggio.

Profondità relativa, non metri

Il risultato è relativo: indica cosa è più vicino e cosa è più lontano nella ripresa, non le distanze in unità reali, e la scala viene adattata a ogni clip. È ciò che serve a ControlNet, allo spostamento geometrico e alla profondità di campo. Non è ciò che serve a uno strumento di misura, e nessun modello basato su una sola videocamera può fornirlo.

Scala di grigi per lavorare, colore per visualizzare

La scala di grigi è il formato di scambio: tutti gli strumenti che usano una mappa di profondità leggono la luminosità, perciò è l'impostazione predefinita. Le quattro scale cromatiche — turbo, inferno, magma e viridis — distribuiscono gli stessi valori su una gamma di tonalità. Questo rende molto più facile distinguere le profondità sullo schermo, ma richiede una riconversione prima dell'uso negli strumenti successivi.

Paghi al secondo, non al mese

Ogni piano include crediti da usare su questa pagina o nel resto di YouArt. Con un nuovo account ricevi crediti di prova gratuiti.

Basic

Per appassionati e curiosi

$9.99/mese
Seleziona piano
  • 1000 crediti
  • Fino a circa 200 immagini al mese
  • Fino a circa 332 s di video al mese
  • Agente creativo intelligente
  • Editor video
  • I modelli più recenti per generare immagini, tra cui GPT Image 2.5, GPT Image 2 e Nano Banana Pro
  • I modelli video più recenti, tra cui Seedance 2
  • Caricamento di volti realistici
  • Generazione vocale con ElevenLabs
  • Senza filigrana
  • Accesso illimitato ai template

Pro

Il più scelto

Per creativi e professionisti

$29.99/mese
Seleziona piano
  • 3300 crediti
  • Fino a circa 1000 immagini al mese
  • Fino a circa 1100 s di video al mese
  • Agente creativo intelligente
  • Editor video
  • I modelli più recenti per generare immagini, tra cui GPT Image 2.5, GPT Image 2 e Nano Banana Pro
  • I modelli video più recenti, tra cui Seedance 2
  • Caricamento di volti realistici
  • Generazione vocale con ElevenLabs
  • Senza filigrana
  • Accesso illimitato ai template

Max

Per utenti esperti e team

$149.99/mese
Seleziona piano
  • 18000 crediti
  • Fino a circa 6000 immagini al mese
  • Fino a circa 6000 s di video al mese
  • Agente creativo intelligente
  • Editor video
  • I modelli più recenti per generare immagini, tra cui GPT Image 2.5, GPT Image 2 e Nano Banana Pro
  • I modelli video più recenti, tra cui Seedance 2
  • Caricamento di volti realistici
  • Generazione vocale con ElevenLabs
  • Senza filigrana
  • Accesso illimitato ai template

Team

Per team e studi

$329.99/mese
Seleziona piano
  • 36300 crediti
  • Fino a circa 12000 immagini al mese
  • Fino a circa 12100 s di video al mese
  • Caricamento di volti realistici
  • Condividi tele, flussi di lavoro e risorse con il team
  • Fino a 10 membri per team
  • Fino a 5 team
  • Gestione per ruoli
  • Gestione dei crediti del team e limiti di spesa
  • Monitoraggio dell'utilizzo per membro

Domande

Domande frequenti sulle mappe di profondità video

Che cos'è una mappa di profondità video?
È un secondo video, della stessa durata del tuo, in cui la luminosità rappresenta la distanza: più un pixel è chiaro, più quel punto è vicino alla videocamera. Conserva i movimenti, gli spostamenti di camera, l'inquadratura e i tempi dell'originale, eliminando colore e texture. Per questo è utile come input per altri strumenti, più che come video da guardare.
Perché non usare un modello di profondità per immagini su ogni fotogramma?
Puoi farlo, ma di solito il risultato sfarfalla. Ogni fotogramma viene stimato indipendentemente, quindi una parete immobile riceve una profondità leggermente diversa a ogni fotogramma e sembra ondeggiare o ribollire. Questo modello analizza ogni fotogramma insieme a quelli vicini, così la geometria statica resta ferma. È proprio questa stabilità temporale il motivo per cui esistono modelli di profondità specifici per i video.
È una profondità metrica? Posso usarla per misurare le distanze?
No. È una profondità relativa: ordina ciò che è più vicino e più lontano nella ripresa, con una scala adattata a ogni clip anziché espressa in metri. È esattamente ciò che serve alla generazione guidata dalla profondità, allo spostamento geometrico, alla nebbia e alla profondità di campo. Per misure reali servono un sensore di profondità o un sistema calibrato con più videocamere, che nessun modello basato su un singolo video può sostituire.
Posso usare il risultato per controllare un modello video IA?
Sì, ed è l'uso più comune. Una mappa di profondità fornisce al modello video la geometria, i movimenti di camera e i tempi del filmato, lasciando completamente libero l'aspetto. Puoi così cambiare del tutto lo stile di una ripresa conservando la disposizione e i movimenti dei soggetti. Usa il risultato in scala di grigi: è il formato richiesto dagli input di controllo.
Quale formato cromatico scegliere?
La scala di grigi, a meno che non ti serva solo per la visualizzazione. Tutti gli strumenti successivi — un input di controllo, il canale di profondità di un programma di compositing o un modificatore di spostamento — leggono la luminosità, quindi un file turbo o viridis va riconvertito prima di poterlo usare. Le scale cromatiche rendono più facile valutare la profondità a occhio e sono quindi utili per revisioni e presentazioni.
Quanto costa? Posso provarlo gratis?
Il costo dipende dalla durata della clip: 8 crediti al secondo. Un video di dieci secondi costa 80 crediti, uno di un minuto ne costa 480. Con un nuovo account ricevi crediti di prova gratuiti, così puoi elaborare una clip breve e vedere il risultato prima di decidere.
Il video di profondità conserva l'audio?
No. Il risultato è senza audio: una mappa di profondità contiene dati visivi e l'eventuale traccia audio dell'originale viene rimossa. Se il montaggio finale richiede l'audio originale, reinseriscilo nell'editor video insieme alla mappa di profondità.
Quali file video posso caricare?
MP4, MOV e WebM, fino a 100 MB per file. Risoluzione e frequenza dei fotogrammi restano quelle dell'originale, senza essere forzate a valori predefiniti: il risultato corrisponde così all'originale fotogramma per fotogramma.

Altri strumenti

Altre cose da fare con lo stesso file

Ognuno svolge un solo compito su un file che hai già, senza prompt da scrivere né editor da imparare a usare.

Esplora tutti i 21 strumenti IA

Oltre una singola elaborazione

Vuoi usare la mappa di profondità, oltre a scaricarla?

Questa pagina esegue un unico passaggio predefinito. Apri l'editor del flusso di lavoro per collegare la mappa di profondità direttamente a un modello video come input di controllo, elaborare più clip con lo stesso grafo o inserirla dopo un aumento di risoluzione.