Junior — Senior
Em que difere o MobileNet v2 do v1 (resíduos invertidos)?
sobes.tech IA
Resposta da IA
O MobileNet v2 difere do v1 principalmente pela introdução do conceito de "resíduos invertidos" com "gargalos lineares".
No MobileNet v1, utilizavam-se conexões residuais normais e convoluções separáveis em profundidade, o que já reduzia a complexidade computacional. No MobileNet v2, a arquitetura é construída de modo que:
- O bloco principal é o "bloco residual invertido": primeiro ocorre uma expansão do número de canais usando uma convolução 1x1 (convolução ponto a ponto), depois uma convolução em profundidade, e no final uma compressão de volta para um número menor de canais.
- As conexões residuais são aplicadas não ao espaço de características expandido, mas ao espaço comprimido (estreito), o que reduz o número de parâmetros e aumenta a eficiência.
- É utilizado um gargalo linear (a última camada do bloco não possui ativação ReLU), para evitar perda de informação na compressão de características.
Isso permite que o MobileNet v2 seja mais eficiente e preciso com os mesmos ou menores recursos computacionais em comparação ao v1.
Exemplo de estrutura do bloco MobileNet v2 (simplificado):
# Pseudocódigo
entrada -> convolução 1x1 (expansão, ReLU6) -> convolução em profundidade (ReLU6) -> convolução 1x1 (projeção, linear) -> soma residual (se as dimensões coincidirem)