Sobes.tech
Middle

Was ist der Unterschied zwischen semantischer Segmentierung, Instanz-Segmentierung und Objekterkennung?

sobes.tech KI

Antwort von AI

Diese drei Aufgaben stehen im Zusammenhang mit der Bildanalyse, haben jedoch unterschiedliche Ziele und Detaillierungsgrade:

  • Objekterkennung (Object Detection): Erkennt und lokalisiert Objekte im Bild, meist mit Begrenzungsrahmen (Bounding Boxes). Zum Beispiel alle Autos auf einem Foto finden und markieren.

  • Semantische Segmentierung (Semantic Segmentation): Kategorisiert jeden Pixel des Bildes, weist ihm eine Klassenmarkierung zu (z.B. Straße, Auto, Person), unterscheidet aber keine einzelnen Objekte derselben Klasse. Alle Pixel von Autos werden gleich markiert, ohne Instanzen zu trennen.

  • Instanzsegmentierung (Instance Segmentation): Kombiniert Erkennung und semantische Segmentierung — klassifiziert nicht nur die Pixel, sondern trennt auch Objekte derselben Klasse in separate Instanzen. Zum Beispiel in einem Bild mit mehreren Autos wird jedes Auto als separates Objekt mit eigener Maske hervorgehoben.

Auf diese Weise liefert die Objekterkennung Begrenzungsrahmen, die semantische Segmentierung Masken nach Klassen ohne Objektdifferenzierung, und die Instanzsegmentierung Masken mit Objektdifferenzierung innerhalb derselben Klasse.