Uma convolução atrous (dilatada) pode nunca usar um pixel na imagem original?
sobes.tech IA
Resposta da IA
A convolução atrous (dilatada) amplia o campo de percepção do filtro, pulando pixels entre os elementos do núcleo da convolução. No entanto, se considerarmos uma camada individual com um tamanho de entrada fixo e parâmetros de convolução, teoricamente cada pixel da imagem de entrada pode ser utilizado, mas não necessariamente — isso depende do tamanho da entrada, do passo (stride), do tamanho do núcleo e do coeficiente de dilatação.
Se o coeficiente de dilatação for muito grande e o tamanho da entrada for pequeno, alguns pixels podem não ser cobertos pelo núcleo de convolução em nenhuma posição, ou seja, não serão utilizados nos cálculos. Isso é especialmente notável com dilatações grandes e imagens de entrada pequenas.
Portanto, em geral, a convolução atrous pode não usar alguns pixels da imagem original se os parâmetros de convolução e o tamanho da entrada forem tais que esses pixels não caem sob o núcleo em nenhum deslocamento.
Exemplo: para um sinal 1D de comprimento 10, um núcleo de tamanho 3 e uma dilatação de 4, o núcleo olhará para as posições [i, i+4, i+8]. Quando i=0, essas posições são 0,4,8; quando i=1, são 1,5,9; e quando i=2, são 2,6,10 (que está fora dos limites). O pixel com índice 3 não será utilizado em nenhuma posição.