Zum Inhalt springen
AI & Machine Learning

Tiefenschätzung

Eine KI-Technik, die aus einem einzelnen zweidimensionalen Foto die dreidimensionale Entfernung von Objekten in einer Szene ableitet.

Monokulare Tiefenschätzung nutzt neuronale Netze, die mit gepaarten Bild- und Tiefendaten trainiert wurden, um aus einem Foto eine Tiefenkarte vorherzusagen. Das Modell lernt visuelle Hinweise, die Menschen für Tiefenwahrnehmung verwenden, darunter relative Größe, Verdeckung, Texturverlauf, atmosphärischer Dunst und perspektivische Konvergenz. Die Tiefenkarte weist jedem Pixel einen Abstandswert zu und ermöglicht 3D-bewusste Bearbeitung. Häufige Anwendungen sind synthetisches Bokeh, Parallaxeffekte für soziale Medien, AR-Objektplatzierung und bessere KI-Segmentierung. Bei Haaren, Glas, spiegelnden Objekten, flachen Texturen und ungewöhnlichen Kamerawinkeln kann die Genauigkeit sinken; daher sollten tiefenbasierte Bearbeitungen vor dem Export kurz an den Kanten geprüft werden. Smartphone-Porträtmodi nutzen Tiefenschätzung, um Motive vom Hintergrund zu trennen und Echtzeitunschärfe zu erzeugen.