Junior — Senior
Quelle est la différence entre MobileNet v2 et v1 (résidus inversés) ?
sobes.tech IA
Réponse de l'IA
MobileNet v2 se distingue de v1 principalement par l'introduction du concept de "résidus inversés" avec des "goulots d'étranglement linéaires".
Dans MobileNet v1, des connexions résiduelles classiques et des convolutions séparables en profondeur étaient utilisées, ce qui réduisait déjà la complexité computationnelle. Dans MobileNet v2, l'architecture est conçue de manière à ce que :
- Le bloc principal est le "bloc résiduel inversé" : d'abord, une extension du nombre de canaux via une convolution 1x1 (convolution pointwise), puis une convolution en profondeur, et enfin une compression pour revenir à un nombre réduit de canaux.
- Les connexions résiduelles sont appliquées non à l'espace de caractéristiques étendu, mais à l'espace comprimé (étroit), ce qui réduit le nombre de paramètres et augmente l'efficacité.
- Un goulot d'étranglement linéaire est utilisé (la dernière couche du bloc n'a pas d'activation ReLU), pour éviter la perte d'information lors de la compression des caractéristiques.
Cela permet à MobileNet v2 d'être plus efficace et précis avec les mêmes ou moins de ressources computationnelles par rapport à v1.
Exemple de structure du bloc MobileNet v2 (simplifié) :
# Pseudocode
entrée -> convolution 1x1 (expansion, ReLU6) -> convolution en profondeur (ReLU6) -> convolution 1x1 (projection, linéaire) -> addition résiduelle (si les dimensions correspondent)