コンテンツへスキップ
AI & Machine Learning

深度推定

1枚の2次元写真から、シーン内の物体までの3次元的な距離を推定するAI技術です。

単眼深度推定は、画像と深度のペアデータで学習したニューラルネットワークを使い、1枚の写真から深度マップを予測します。モデルは、相対的な大きさ、遮蔽、テクスチャの勾配、大気のかすみ、遠近法の収束など、人間が奥行きを感じる視覚的手がかりを学習します。生成された深度マップは各ピクセルに距離値を割り当て、3Dを意識した編集を可能にします。主な用途は、合成ボケ、SNS向けのパララックス効果、ARオブジェクト配置、AIセグメンテーション精度の向上です。髪、ガラス、反射物、平坦な質感、珍しいカメラ角度では精度が落ちることがあるため、深度を使った編集は書き出し前にエッジを確認するのが安全です。スマートフォンのポートレートモードは、深度推定で被写体を背景から分離し、リアルタイムのぼかし効果を作ります。