AI深度マップ生成

AI深度マップ生成:写真を深度マップに変換

画像をアップロードすると、グレースケールの深度マップが返ります。明るいほど手前、暗いほど奥です。シーンに合った推定モデルを選び、生成の構造ガイドとして、あるいは 3D やパララックスのディスプレイスメント素材として使えます。

深度推定モデル

汎用の既定。まずはこれで。

2 クレジット
遠くの交差点へ伸びる街路の写真同じ街路を Depth Anything で処理した深度マップ。手前から奥へなめらかに変化し、駐車中の車が淡い塊として浮かぶ。空は黒

サンプル

深度マップの例

  • 遠くの交差点へ伸びる街路の写真
    同じ街路を Depth Anything で処理した深度マップ。手前から奥へなめらかに変化し、駐車中の車が淡い塊として浮かぶ。空は黒
    Depth Anything — 既定
  • 遠くの交差点へ伸びる街路の写真
    同じ街路を MiDaS で処理した深度マップ。全体に暗く、通りの奥が一枚の暗い帯に潰れている
    MiDaS — 奥の分離がより平坦
  • 遠くの交差点へ伸びる街路の写真
    同じ街路を ZoeDepth で処理した深度マップ。コントラストがはるかに強く、手前の壁面はほぼ白、奥はほぼ黒
    ZoeDepth — 最も高コントラスト

使い方

3ステップで深度マップを作成

  1. ステップ 1

    写真をアップロード

    JPG、PNG、WebP を1枚ドロップします。街路・部屋・遠景など実際に奥行きのある場面のほうが、無地の背景に置いた平らな物体よりはるかによく読み取れます。

  2. ステップ 2

    推定モデルを選ぶ

    3つのモデルは同じ場面を3通りに読み取ります。迷ったら既定の Depth Anything のままで構いません。他の2つが向く場面は下の節で説明しています。

  3. ステップ 3

    ダウンロード、または続けて作業

    深度マップは生成セッションで開くので、ダウンロードすることも、やり直すことなくそのままモデルの深度ガイドとしてつなぐこともできます。

モデルを選ぶ

どの深度推定モデルを使うか

3つとも返すのは相対深度、つまり1枚の中での遠近です。数値がどう見えても、実世界の距離を測るものではありません。

Depth Anything

人物・物体・屋外シーンまで安定して扱える汎用の相対深度。既定であり、ほとんどの写真にはこれが正解です。

MiDaS

屋内外を問わず相対深度の層構造が強く出ます。なめらかな階調より、場面の各層をはっきり分けたいときに選んでください。

ZoeDepth

部屋・建築・3D空間作業に向けたメトリック寄りの深度。3つの中では実距離に最も近い読み取りですが、それでも測定値ではありません。

用途

深度マップの使いどころ

ControlNet の深度条件付け

最も多い用途です。深度マップは実際の場面の形状を生成モデルに渡すので、新しい画像は空間配置を保ったまま見た目だけを大きく変えられます。

パララックスと2.5Dモーション

深度チャンネルに沿って静止画をディスプレイスすると、カメラを横に振ったときに平面の写真が立体感を持ちます。

合成と被写界深度

深度チャンネルがあれば、手描きの選択範囲ではなく距離に応じてフォグ・グレーディング・ぼかしをかけられます。

3Dと空間メディア

深度マップは3Dパイプラインのディスプレイスメントを駆動し、ヘッドセットが読む空間写真フォーマットの素材にもなります。

クレジットとプラン

深度マップ1枚につき一律2クレジット。写真のサイズや選んだモデルは問いません。

Basic

趣味で楽しむ方や新しい表現を探求したい方に

$9.99/月
プランを選択
  • 1000クレジット
  • 月に最大約200枚の画像
  • 月に約1000秒以上の動画
  • 高性能なクリエイティブエージェント
  • 動画エディター
  • GPT Image 2.5、GPT Image 2、Nano Banana Proなどの最新画像モデル
  • Seedance 2などの最新動画モデル
  • 実写の顔写真をアップロード可能
  • ElevenLabsによる音声生成
  • 透かしなし
  • テンプレートを無制限に利用

Pro

一番人気

クリエイターやプロユーザーに

$29.99/月
プランを選択
  • 3300クレジット
  • 月に最大約1000枚の画像
  • 月に約3300秒以上の動画
  • 高性能なクリエイティブエージェント
  • 動画エディター
  • GPT Image 2.5、GPT Image 2、Nano Banana Proなどの最新画像モデル
  • Seedance 2などの最新動画モデル
  • 実写の顔写真をアップロード可能
  • ElevenLabsによる音声生成
  • 透かしなし
  • テンプレートを無制限に利用

Max

ヘビーユーザーやチームに

$149.99/月
プランを選択
  • 18000クレジット
  • 月に最大約6000枚の画像
  • 月に約18000秒以上の動画
  • 高性能なクリエイティブエージェント
  • 動画エディター
  • GPT Image 2.5、GPT Image 2、Nano Banana Proなどの最新画像モデル
  • Seedance 2などの最新動画モデル
  • 実写の顔写真をアップロード可能
  • ElevenLabsによる音声生成
  • 透かしなし
  • テンプレートを無制限に利用

Team

チームやスタジオに

$329.99/月
プランを選択
  • 36300クレジット
  • 月に最大約12000枚の画像
  • 月に約36300秒以上の動画
  • 実写の顔写真をアップロード可能
  • キャンバス、ワークフロー、アセットをチームで共有
  • 1チームあたり最大10人
  • 最大5チーム
  • 役割に基づく管理
  • チームのクレジット管理と利用上限
  • メンバー別の利用状況を追跡

よくある質問

深度マップについて

深度マップとは何ですか?
明るさが距離を表すグレースケール画像です。手前ほど明るく、奥ほど暗くなります。場面の形状を記録し、色や質感は捨てます。だからこそ構造ガイドとして使えます。
これはメトリック深度ですか?実際の距離が得られますか?
いいえ。3つのモデルが返すのは相対深度で、画面内の各部分が互いにどれだけ手前か奥かを示すもので、何メートル先かではありません。ZoeDepth はメトリック寄りで最も近いものの、これらの出力を測定値として扱えば誤った数値になります。
どのモデルを選べばよいですか?
ほとんどの写真は Depth Anything で、これが既定です。なめらかな階調よりも場面の層をはっきり分けたいときは MiDaS。相対的なスケールが重要な部屋・建築・3D作業では ZoeDepth。料金は3つとも同じなので、もう1つ試すのは安上がりです。
出力を ControlNet の深度入力に使えますか?
はい、多くの方はそのために生成しています。出力は標準的なグレースケール深度画像なので、深度条件入力を受け付ける場所ならどこでも使えます。結果は生成セッションで開くため、ダウンロードせずにそのままモデルへつなげます。
動画でも同じことができますか?
このページではできません。動画深度マップのツールをお使いください。映像向けに作られた別のモデルで、違いは実質的です。静止画用の推定をフレームごとに回すと、あるフレームの読み取りを次につなぐ仕組みがないため、深度がちらつきます。
アップロードできる画像形式は?
JPG、PNG、WebP に対応し、1回につき1枚です。深度マップは標準的な画像形式で返るので、ダウンロードも別ノードへの受け渡しもできます。
写真はブラウザ内で処理されますか?
いいえ。端末内だけで完結する深度ツールもありますが、これは違います。写真はアップロードされ、当社のサーバー上で処理されます。そのおかげで、どの端末からでも同じ3つのモデルを実行できます。モデルを選べることよりファイルを外に出さないことを重視するなら、ローカルのツールのほうが向いています。

その他のツール

同じファイルでできる、ほかのこと

どれも、すでに手元にあるファイルに対して1つの仕事だけをします。プロンプトを書く必要も、エディタを覚える必要もありません。

14 種類のAIツールをすべて見る

作成を始める

写真を深度マップに

画像を1枚アップロードし、推定モデルを選べば、数秒でグレースケールの深度マップが返ります。