動画向けの AI 深度推定

AI 動画デプスマップ生成ツール:どんなクリップも深度パスに変換

動画をアップロードすると、フレームごとのデプスマップが返ります。明るいほどカメラに近く、暗いほど遠くです。動き、カメラワーク、構図、タイミングはすべて残り、色とテクスチャは残りません。それこそが狙いです。実写素材の構造だけを動画モデルや合成ソフト、3D ツールに渡し、見た目は持ち込まずに済みます。

出力形式

後段のツールが読み取れるのはグレースケールだけです。カラーマップは目視確認用です。

動画 1 秒あたり 8 クレジット

1 本あたり 100 MB まで

40 クレジット

生成されたデプス動画は、あとから開き直せるセッションに表示されます。そのままダウンロードすることも、別のツールに引き継ぐこともできます。

使い方

3 ステップでデプスマップを作成

  1. ステップ 1

    動画をアップロード

    MP4、MOV、WebM を 100 MB までドロップします。解像度とフレームレートは元の動画に従うため、取り込み時にリサイズや再サンプリングは行いません。

  2. ステップ 2

    フレームごとに深度を推定

    モデルは各フレームを単独で見るのではなくクリップ全体を読み取り、各ピクセルのカメラからの距離を書き出します。前後のフレームを参照するため、動いていない壁は同じ深度を保ち、フレームごとにずれることがありません。

  3. ステップ 3

    生成してダウンロード

    デプス動画はあとから開き直せるセッションに表示されます。ダウンロードする、次のクリップを処理する、あるいは動画モデルの制御入力としてワークフローエディタに持ち込む、いずれも可能です。

変換前と変換後

同じ画を、距離として書き直す

  • 何十人もの人物が何十通りもの距離に配置され、そのすべてが互いに分離されています。手前のほぼ白い人影から消失点の黒まで、階調の全域が使われています。
  • 被写体の数は少ないものの距離差が大きく、細部の構造も保たれています。植物の葉は一枚ずつ分離され、戸口の奥の部屋はその周囲の壁より正しく遠くと判定されています。

主な用途

モデルや合成担当が必要としているのは、ピクセルではなく構造

深度で誘導する動画生成

デプスパスを制御入力として動画モデルに渡すと、素材のレイアウト、カメラワーク、タイミングを踏襲しながら、まったく別の見た目を生成できます。深度が運ぶのは幾何構造だけで、元素材の顔・色・テクスチャは持ち込まれません。

合成とカラーグレーディング

デプスパスは After Effects、Nuke、Fusion、Resolve での被写界深度、大気遠近、フォグ、再ライティングを駆動します。本来なら手作業でロトスコープするマットに相当し、しかもカット内の動きに合わせて自動的に更新されます。

3D・空間ビデオ・視差

デプスマップで平面をディスプレイスすれば、平坦な映像に本物の視差が生まれます。2.5D のカメラ移動、空間ビデオへの変換、ウィグルステレオなど。これらの効果が等しく必要とするのが深度という一つのチャンネルであり、それはカメラが記録してくれないものです。

手前と奥を切り分ける

深度は硬い切り抜きではなく連続値なので、しきい値を好きな位置に置けます。前景の被写体だけを取り出す、背景だけを差し替える、中景だけを個別にグレーディングする——いずれも色に頼らずに行えます。

推定の仕組み

動画のために作られている。だから安定する

各フレームの前後を読んでいる

画像用の深度モデルをクリップにフレームごとに当てると、深度が沸き立ちます。各フレームが独立に推定を行い、その推定同士がわずかに食い違うため、平らな面が這うように動き、輪郭がざわつきます。動画用の深度モデルは前後のフレームをまとめて読むので、動いていない面は同じ値を保ち、編集で使えるパスになります。

相対深度であり、メートルではない

出力は相対的です。ショット内で何が手前で何が奥かは分かりますが、実寸での距離は分からず、スケールはクリップごとに取り直されます。ControlNet、ディスプレイスメント、被写界深度が求めているのはまさにこれです。計測用途には向きませんし、単一カメラのモデルに実寸を求めることはできません。

作業はグレースケール、確認はカラー

グレースケールは共通の受け渡し形式です。デプスマップを読み込むツールはどれも輝度を見るため、既定値もこれにしています。turbo、inferno、magma、viridis の 4 種は同じ値を色相方向に広げるもので、画面上で深度の前後関係を判断するにははるかに読みやすい一方、後段で使う前にグレースケールへ戻す必要があります。

月額ではなく、秒単位で支払う

どのプランにもクレジットが含まれ、このページでも YouArt の他の機能でも使えます。新規アカウントには無料のトライアルクレジットが付きます。

Basic

趣味で楽しむ方や新しい表現を探求したい方に

$9.99/月
プランを選択
  • 1000クレジット
  • 月に最大約200枚の画像
  • 月に約1000秒以上の動画
  • 高性能なクリエイティブエージェント
  • 動画エディター
  • GPT Image 2、Nano Banana Proなどの最新画像モデル
  • Seedance 2などの最新動画モデル
  • 実写の顔写真をアップロード可能
  • ElevenLabsによる音声生成
  • 透かしなし
  • テンプレートを無制限に利用

Pro

一番人気

クリエイターやプロユーザーに

$29.99/月
プランを選択
  • 3300クレジット
  • 月に最大約1000枚の画像
  • 月に約3300秒以上の動画
  • 高性能なクリエイティブエージェント
  • 動画エディター
  • GPT Image 2、Nano Banana Proなどの最新画像モデル
  • Seedance 2などの最新動画モデル
  • 実写の顔写真をアップロード可能
  • ElevenLabsによる音声生成
  • 透かしなし
  • テンプレートを無制限に利用

Max

ヘビーユーザーやチームに

$149.99/月
プランを選択
  • 18000クレジット
  • 月に最大約6000枚の画像
  • 月に約18000秒以上の動画
  • 高性能なクリエイティブエージェント
  • 動画エディター
  • GPT Image 2、Nano Banana Proなどの最新画像モデル
  • Seedance 2などの最新動画モデル
  • 実写の顔写真をアップロード可能
  • ElevenLabsによる音声生成
  • 透かしなし
  • テンプレートを無制限に利用

Team

チームやスタジオに

$329.99/月
プランを選択
  • 36300クレジット
  • 月に最大約12000枚の画像
  • 月に約36300秒以上の動画
  • 実写の顔写真をアップロード可能
  • キャンバス、ワークフロー、アセットをチームで共有
  • 1チームあたり最大10人
  • 最大5チーム
  • 役割に基づく管理
  • チームのクレジット管理と利用上限
  • メンバー別の利用状況を追跡

よくある質問

動画デプスマップに関するよくある質問

動画のデプスマップとは何ですか。
元の動画と同じ長さで、明るさが距離を表すもう 1 本の動画です。ピクセルが明るいほど、その地点はカメラに近いことを意味します。元の動き、カメラワーク、構図、タイミングは保たれ、色とテクスチャは失われます。だからこそ、鑑賞するためのものではなく、別の処理への入力として役立ちます。
画像用の深度モデルを全フレームに適用するのでは駄目ですか。
できますが、たいてい結果がちらつきます。フレームごとに独立して推定されるため、一度も動いていない壁が毎フレーム少しずつ違う深度になり、這うように、あるいは沸き立つように見えます。このモデルは各フレームの前後を読むので、静止した形状は動きません。この時間的な安定性こそ、動画専用の深度モデルが存在する理由のすべてです。
これは絶対深度ですか。距離の計測に使えますか。
いいえ。相対深度です。ショット内での遠近の順序を示すもので、スケールはメートルではなくクリップごとに合わせ直されます。深度誘導の生成、ディスプレイスメント、フォグ、被写界深度が必要とするのはまさにこれです。実測値が必要な場合は深度センサーか較正済みのマルチカメラ装置が要り、単一動画のモデルでは代替できません。
出力を AI 動画モデルの制御に使えますか。
使えます。むしろデプスマップを作る最も一般的な理由がこれです。デプスパスは素材の幾何構造・カメラワーク・タイミングを動画モデルに渡しつつ、見た目は完全に自由なままにします。そのためショットの見た目を全面的に作り替えても、画づくりの配置は保てます。この用途にはグレースケール出力を使ってください。制御入力が想定しているのはそちらです。
どのカラー出力を選べばよいですか。
目で見るだけの場合を除き、グレースケールを選んでください。後段のすべて——制御入力、合成ソフトの深度チャンネル、ディスプレイスメントモディファイア——は輝度を読むため、turbo や viridis のファイルは使う前にグレースケールへ戻す必要があります。カラーマップは目視で深度を判断するには確かに優れているので、確認やプレゼンには有用です。
料金はいくらですか。無料で試せますか。
クリップの長さに応じた課金で、1 秒あたり 8 クレジットです。10 秒の動画で 80 クレジット、1 分で 480 クレジットになります。新規アカウントには無料のトライアルクレジットが付くので、短いクリップで結果を確かめてから判断できます。
デプス動画に元の音声は残りますか。
残りません。出力は無音です。デプスマップは映像データであり、元素材の音声トラックは取り除かれます。最終的な仕上げで元の音声が必要な場合は、動画エディタでデプスパスと合わせて戻してください。
どの動画形式をアップロードできますか。
MP4、MOV、WebM で、1 ファイル 100 MB までです。解像度とフレームレートはプリセットに強制されず元の動画に従うため、出力は入力とフレーム単位で一致します。

その他のツール

同じファイルでできる、ほかのこと

どれも、すでに手元にあるファイルに対して1つの仕事だけをします。プロンプトを書く必要も、エディタを覚える必要もありません。

9 種類のAIツールをすべて見る

1 本のパスにとどまらず

深度を、ダウンロードするだけでなく実際に使いたいですか。

このページが実行するのは固定の 1 ステップだけです。ワークフローエディタを開けば、デプスパスを動画モデルの制御入力に直接つなぐことも、同じグラフでクリップをまとめて処理することも、アップスケールの後段につなぐこともできます。