YouArt

Estimation de profondeur par IA pour la vidéo

Générateur de cartes de profondeur vidéo par IA : transformer n’importe quelle vidéo en passe de profondeur

Déposez une vidéo et obtenez une carte de profondeur pour chaque image : les zones claires sont proches de la caméra, les zones sombres sont plus éloignées.

Sortie

Les niveaux de gris sont lisibles par tous les outils utilisés ensuite. Les dégradés de couleurs servent à la visualisation.

8 crédits par seconde de vidéo

Jusqu’à 100 Mo par vidéo

40 crédits

La vidéo de profondeur s’ouvre dans une session que vous pouvez retrouver, prête à être téléchargée ou utilisée dans un autre outil.

Vidéo source
Carte de profondeur — résultat de cet outil
Un modèle vidéo guidé par cette carte
Cette page produit uniquement la vidéo du milieu. Utilisez-la comme entrée de contrôle pour un modèle vidéo dans l’éditeur de flux de travail : les mouvements, le cadrage et le rythme seront conservés, tandis que tout le reste sera remplacé.

Comment ça marche

Créer une carte de profondeur en trois étapes

  1. Étape 1

    Importer votre vidéo

    Déposez un fichier MP4, MOV ou WebM de 100 Mo maximum. La résolution et la fréquence d’images restent celles de la source : aucun redimensionnement ni rééchantillonnage n’est effectué à l’importation.

  2. Étape 2

    La profondeur est estimée pour chaque image

    Le modèle analyse l’ensemble de la vidéo plutôt que chaque image isolément, puis représente la distance entre chaque pixel et la caméra. Grâce à l’analyse des images voisines, un mur immobile garde la même profondeur au lieu de varier d’une image à l’autre.

  3. Étape 3

    Générer et télécharger

    La vidéo de profondeur s’ouvre dans une session que vous pouvez retrouver. Vous pouvez la télécharger, traiter la vidéo suivante ou utiliser le résultat dans l’éditeur de flux de travail comme entrée de contrôle pour un modèle vidéo.

Avant et après

Le même plan, traduit en distances

  • Des dizaines de personnes à des dizaines de distances, chacune distincte des autres. Toute la gamme de tons est utilisée, des silhouettes presque blanches en bas de l’image au noir du point de fuite.
  • Quelques sujets à des distances très différentes, dont les détails fins restent visibles : chaque feuille de la plante est distincte, et la pièce au-delà de la porte est correctement représentée comme plus éloignée que le mur qui l’entoure.
  • À courte distance, le modèle distingue la FORME, pas seulement la distance : la tasse apparaît comme un objet arrondi plutôt qu’une zone plate, et la profondeur du bureau évolue progressivement sous elle.

À quoi ça sert

Quand un modèle ou un outil de composition a besoin de structure, pas de pixels

Génération vidéo guidée par la profondeur

Fournissez la passe de profondeur à un modèle vidéo comme entrée de contrôle : il suivra la composition, les mouvements de caméra et le rythme de votre vidéo tout en créant un rendu entièrement différent. La profondeur transmet la géométrie sans reprendre les visages, les couleurs ni les textures de l’original.

Composition et étalonnage

Une passe de profondeur pilote la profondeur de champ, la brume atmosphérique, le brouillard et le rééclairage dans After Effects, Nuke, Fusion ou Resolve. Elle fournit le masque que vous devriez autrement créer à la main par rotoscopie, et se met à jour au fil des mouvements du plan.

3D, vidéo spatiale et parallaxe

Déformez un plan à l’aide de la carte de profondeur pour donner une véritable parallaxe à une vidéo plate : mouvement de caméra en 2,5D, conversion en vidéo spatiale ou effet stéréoscopique par alternance de vues. La profondeur est le canal dont tous ces effets ont besoin et qu’aucune caméra n’enregistre.

Séparer le proche du lointain

La profondeur étant continue, contrairement à un détourage aux contours nets, vous pouvez fixer un seuil où vous le souhaitez : isoler le sujet au premier plan, supprimer uniquement l’arrière-plan ou étalonner les plans intermédiaires séparément, sans sélection par couleur.

Comment fonctionne l’estimation

Une conception pensée pour la vidéo, gage de stabilité

Le modèle analyse les images voisines de chaque image

Appliquer un modèle d’estimation de la profondeur conçu pour les images fixes à une vidéo, image par image, produit des fluctuations : chaque image reçoit une estimation indépendante, et ces estimations diffèrent légèrement. Les surfaces planes semblent alors onduler et les contours vibrent. Un modèle conçu pour la vidéo analyse les images voisines ensemble : une surface immobile conserve ainsi la même valeur, et la passe reste exploitable au montage.

Une profondeur relative, pas une mesure en mètres

Le résultat est relatif : il indique ce qui est plus proche ou plus éloigné dans un plan, sans donner de distances en unités réelles. L’échelle est ajustée pour chaque vidéo. C’est ce dont ont besoin ControlNet, le déplacement et la profondeur de champ. Ce résultat ne convient pas à un outil de mesure, et aucun modèle utilisant une seule caméra ne peut fournir de telles mesures.

Niveaux de gris pour travailler, couleurs pour visualiser

Les niveaux de gris constituent le format d’échange : tous les outils qui exploitent une carte de profondeur lisent la luminosité. C’est donc le format par défaut. Les quatre dégradés de couleurs — turbo, inferno, magma et viridis — répartissent les mêmes valeurs sur une gamme de teintes. Ils rendent les différents niveaux de profondeur bien plus lisibles à l’écran, mais doivent être reconvertis en niveaux de gris avant toute utilisation dans un autre outil.

Payer à la seconde, pas au mois

Chaque offre comprend des crédits utilisables sur cette page ou ailleurs sur YouArt, et tout nouveau compte bénéficie de crédits d’essai gratuits.

De base

Pour les amateurs et les curieux

$9.99/mois
Choisir une formule
  • 1000 crédits
  • Jusqu’à environ 200 images/mois
  • Jusqu’à environ 332 s de vidéo/mois
  • Agent créatif intelligent
  • Éditeur vidéo
  • Derniers modèles d’image, dont GPT Image 2.5, GPT Image 2 et Nano Banana Pro
  • Derniers modèles vidéo, dont Seedance 2
  • Importation de visages réalistes
  • Génération de voix avec ElevenLabs
  • Sans filigrane
  • Accès illimité aux modèles

Pro

La plus populaire

Pour les créateurs et les professionnels

$29.99/mois
Choisir une formule
  • 3300 crédits
  • Jusqu’à environ 1000 images/mois
  • Jusqu’à environ 1100 s de vidéo/mois
  • Agent créatif intelligent
  • Éditeur vidéo
  • Derniers modèles d’image, dont GPT Image 2.5, GPT Image 2 et Nano Banana Pro
  • Derniers modèles vidéo, dont Seedance 2
  • Importation de visages réalistes
  • Génération de voix avec ElevenLabs
  • Sans filigrane
  • Accès illimité aux modèles

Max

Pour les utilisateurs avancés et les équipes

$149.99/mois
Choisir une formule
  • 18000 crédits
  • Jusqu’à environ 6000 images/mois
  • Jusqu’à environ 6000 s de vidéo/mois
  • Agent créatif intelligent
  • Éditeur vidéo
  • Derniers modèles d’image, dont GPT Image 2.5, GPT Image 2 et Nano Banana Pro
  • Derniers modèles vidéo, dont Seedance 2
  • Importation de visages réalistes
  • Génération de voix avec ElevenLabs
  • Sans filigrane
  • Accès illimité aux modèles

Équipe

Pour les équipes et les studios

$329.99/mois
Choisir une formule
  • 36300 crédits
  • Jusqu’à environ 12000 images/mois
  • Jusqu’à environ 12100 s de vidéo/mois
  • Importation de visages réalistes
  • Partager des canevas, des flux de travail et des ressources avec votre équipe
  • Jusqu’à 10 membres par équipe
  • Jusqu’à 5 équipes
  • Gestion par rôle
  • Gestion des crédits de l’équipe et plafonds de dépenses
  • Suivi de l’utilisation par membre

Questions

FAQ sur les cartes de profondeur vidéo

Qu’est-ce qu’une carte de profondeur vidéo ?
C’est une seconde vidéo, de même durée que la vôtre, où la luminosité représente la distance : plus un pixel est clair, plus le point correspondant est proche de la caméra. Elle conserve les mouvements, le déplacement de la caméra, le cadrage et le rythme de l’original, mais supprime les couleurs et les textures. Elle sert donc de donnée d’entrée pour d’autres traitements plutôt que de vidéo à regarder.
Pourquoi ne pas simplement appliquer à chaque image un modèle d’estimation de la profondeur conçu pour les images fixes ?
C’est possible, mais le résultat scintille généralement. Chaque image est estimée indépendamment : un mur immobile reçoit donc une profondeur légèrement différente à chaque image et semble onduler ou vibrer. Ce modèle analyse les images voisines de chaque image, ce qui permet aux éléments fixes de rester stables. Cette stabilité temporelle est précisément la raison d’être d’un modèle de profondeur conçu pour la vidéo.
S’agit-il d’une profondeur métrique ? Puis-je mesurer des distances avec cet outil ?
Non. Il s’agit d’une profondeur relative : elle classe les éléments du plus proche au plus éloigné dans un plan, avec une échelle ajustée pour chaque vidéo plutôt qu’exprimée en mètres. C’est exactement ce dont ont besoin la génération guidée par la profondeur, le déplacement, le brouillard et la profondeur de champ. Pour obtenir de véritables mesures, il faut un capteur de profondeur ou un dispositif multicaméra calibré, qu’aucun modèle utilisant une seule vidéo ne peut remplacer.
Puis-je utiliser le résultat pour guider un modèle vidéo IA ?
Oui, c’est même l’usage le plus courant. Une passe de profondeur transmet au modèle vidéo la géométrie, le mouvement de caméra et le rythme de votre séquence, tout en laissant son apparence entièrement libre. Vous pouvez ainsi changer complètement le style d’un plan tout en conservant la mise en scène. Utilisez pour cela la sortie en niveaux de gris : c’est le format attendu par les entrées de contrôle.
Quel mode de couleur choisir pour la sortie ?
Choisissez les niveaux de gris, sauf si vous souhaitez uniquement visualiser le résultat. Tous les outils qui l’exploiteront ensuite — entrée de contrôle, canal de profondeur d’un logiciel de compositing ou modificateur de déplacement — lisent la luminosité. Un fichier turbo ou viridis doit donc être reconverti avant de pouvoir être utilisé. Les dégradés de couleurs facilitent nettement l’évaluation visuelle de la profondeur et sont donc utiles pour la vérification et la présentation.
Combien cela coûte-t-il et puis-je essayer gratuitement ?
La facturation dépend de la durée de la vidéo, à raison de 8 crédits par seconde : une vidéo de dix secondes coûte 80 crédits, et une minute coûte 480 crédits. Tout nouveau compte bénéficie de crédits d’essai gratuits, pour vous permettre de traiter une courte vidéo et d’examiner le résultat avant de vous décider.
La vidéo de profondeur conserve-t-elle ma piste audio ?
Non. Le résultat est muet : une carte de profondeur contient des données visuelles, et toute piste audio de la source est supprimée. Si votre montage final doit conserver l’audio d’origine, ajoutez-le dans votre logiciel de montage avec la passe de profondeur.
Quels fichiers vidéo puis-je importer ?
Les formats MP4, MOV et WebM sont acceptés, jusqu’à 100 Mo par fichier. La résolution et la fréquence d’images suivent celles de la source plutôt qu’un préréglage imposé : le résultat correspond donc à l’original image par image.

Autres outils

D’autres possibilités avec le même fichier

Chaque outil accomplit une tâche précise sur un fichier que vous possédez déjà, sans prompt à rédiger ni éditeur à maîtriser.

Découvrir les 21 outils IA

Au-delà d’une seule passe

Envie d’exploiter la profondeur, au-delà du téléchargement ?

Cette page exécute une seule étape prédéfinie. Ouvrez l’éditeur de flux de travail pour connecter directement la passe de profondeur à l’entrée de contrôle d’un modèle vidéo, traiter un lot de vidéos avec le même graphe ou l’enchaîner après une augmentation de résolution.