Middle
Quelles sont les trois matrices utilisées dans l'attention multi-tête?
sobes.tech IA
Réponse de l'IA
Dans l'attention multi-tête, trois matrices principales sont utilisées, formées à partir des données d'entrée :
- Query (Q) — matrice de requêtes, qui détermine quels éléments de l'entrée doivent être pris en compte.
- Key (K) — matrice de clés, utilisée pour faire correspondre avec les requêtes et déterminer la pertinence.
- Value (V) — matrice de valeurs, contenant l'information qui sera agrégée dans le résultat de l'attention.
Le processus d'attention calcule les poids d'attention comme le produit scalaire entre Q et K, les normalise et les applique à V pour obtenir une somme pondérée des valeurs. Dans l'attention multi-tête, ce processus est répété plusieurs fois en parallèle avec différentes projections de Q, K et V, permettant au modèle de capturer différents aspects de l'information.