Ein Verfahren aus dem Bereich Computer Vision, das ein Bild in pixelgenaue Regionen unterteilt – wie etwa eine Person, deren Kleidung und den Hintergrund.
Was ist Bildsegmentierung? Die Bildsegmentierung ist ein Prozess aus dem Bereich Computer Vision, der ein digitales Bild auf Pixelebene in verschiedene Bereiche unterteilt. Während die einfache Objekterkennung nur feststellt: „Auf diesem Foto ist eine Person“, zeichnet die Segmentierung die exakten Konturen dieser Person nach. Sie trennt das Motiv vom Hintergrund, die Haare vom Gesicht und einzelne Kleidungsstücke voneinander. Die Variante auf Ebene der Kleidung wird oft als Person Parsing bezeichnet: Hierbei wird jedem Pixel ein Label wie Haut, Haar, Oberteil, Hose, Schuhe oder Hintergrund zugewiesen.
Ein Foto und seine Segmentierungskarte mit farbcodierten Bereichen ## Die Rolle bei der virtuellen Anprobe Die Segmentierung ist einer der ersten Schritte in einer Try-on-Pipeline: 1. Kleidungsmaskierung (Garment Masking): Die exakten Pixel des zu ersetzenden Kleidungsstücks werden identifiziert. Diese dienen als Maske für das Image Inpainting. 2. Hintergrundisolation: Stellt sicher, dass die Umgebung der Person bei der Bildgenerierung unangetastet bleibt. 3. Umgang mit Verdeckungen (Occlusions): Erkennt Haare, Hände oder Accessoires, die sich vor der Kleidung befinden, damit diese über dem neuen Kleidungsstück sichtbar bleiben. Die Segmentierung teilt dem System auf Pixelebene mit, wo sich Dinge befinden; die Posenschätzung (Pose Estimation) liefert Informationen darüber, wie der Körper positioniert ist. Für den Kleidungstransfer ist beides erforderlich.
FAQ
Deine Fragen, beantwortet.
Was ist der Unterschied zwischen Segmentierung und Hintergrundentfernung?↓
Die Hintergrundentfernung ist lediglich ein Anwendungsfall der Segmentierung: eine einfache Aufteilung in zwei Bereiche (Motiv und Hintergrund). Für die virtuelle Anprobe ist jedoch eine viel feinere Analyse nötig, um einzelne Kleidungsstücke, Haut und Haare der Person exakt voneinander zu unterscheiden.