Kann eine atrous (gedehnte) Faltung überhaupt niemals einen Pixel im ursprünglichen Bild verwenden?
sobes.tech KI
Antwort von AI
Atrous (dilated) Faltung erweitert das Wahrnehmungsfeld des Filters, indem es Pixel zwischen den Elementen des Faltungskerns überspringt. Wenn man jedoch eine einzelne Schicht mit fester Eingangsgröße und Faltungseinstellungen betrachtet, kann theoretisch jeder Pixel des Eingabebildes verwendet werden, aber nicht unbedingt — das hängt von der Eingangsgröße, dem Schritt (Stride), der Kerngröße und dem Dilatationsfaktor ab.
Wenn der Dilatationsfaktor zu groß ist und die Eingangsgröße klein ist, können einige Pixel in keiner Position vom Faltungskern abgedeckt werden, also werden sie in den Berechnungen nicht verwendet. Dies ist besonders bei großen Dilatationen und kleinen Eingabebildern sichtbar.
Daher kann die atrous-Faltung im Allgemeinen einige Pixel des Originalbildes nicht verwenden, wenn die Faltungseinstellungen und die Eingangsgröße so sind, dass diese Pixel in keinem Verschiebungswinkel vom Kern abgedeckt werden.
Beispiel: Für ein 1D-Signal der Länge 10, einen Kern der Größe 3 und eine Dilatation von 4, schaut der Kern auf die Positionen [i, i+4, i+8]. Bei i=0 sind das die Positionen 0,4,8; bei i=1 sind es 1,5,9; und bei i=2 sind es 2,6,10 (außerhalb der Grenzen). Das Pixel mit Index 3 wird in keiner Position verwendet.