¿Puede una convolución atrous (dilatada) nunca usar un píxel en la imagen original?
sobes.tech AI
Respuesta de la IA
La convolución atrous (dilatada) amplía el campo receptivo del filtro, saltando píxeles entre los elementos del núcleo de la convolución. Sin embargo, si consideramos una capa individual con un tamaño de entrada fijo y parámetros de convolución, teóricamente cada píxel de la imagen de entrada puede ser utilizado, pero no necesariamente — esto depende del tamaño de la entrada, el paso (stride), el tamaño del núcleo y el coeficiente de dilatación.
Si el coeficiente de dilatación es demasiado grande y el tamaño de entrada es pequeño, algunos píxeles pueden no ser cubiertos por el núcleo de la convolución en ninguna posición, es decir, no serán utilizados en los cálculos. Esto es especialmente notable con dilataciones grandes y pequeñas imágenes de entrada.
Por lo tanto, en general, la convolución atrous puede no usar algunos píxeles de la imagen original si los parámetros de la convolución y el tamaño de entrada son tales que estos píxeles no caen bajo el núcleo en ningún desplazamiento.
Ejemplo: para una señal 1D de longitud 10, un núcleo de tamaño 3 y una dilatación de 4, el núcleo mirará en las posiciones [i, i+4, i+8]. Cuando i=0, estas posiciones son 0,4,8; cuando i=1, son 1,5,9; y cuando i=2, son 2,6,10 (que está fuera de los límites). El píxel con índice 3 no será utilizado en ninguna posición.