Middle
Jakie trzy macierze są używane w wielogłowej uwadze?
sobes.tech AI
Odpowiedź od AI
W wielogłowej uwadze (multihead attention) używa się trzech głównych macierzy, które są tworzone na podstawie danych wejściowych:
- Query (Q) — macierz zapytań, która określa, na które elementy wejścia należy zwrócić uwagę.
- Key (K) — macierz kluczy, używana do dopasowania z zapytaniami i określenia istotności.
- Value (V) — macierz wartości, zawierająca informacje, które będą agregowane w wyniku uwagi.
Proces uwagi oblicza wagi uwagi jako iloczyn skalarny między Q a K, normalizuje je i stosuje do V, aby uzyskać ważoną sumę wartości. W wielogłowej uwadze proces ten powtarza się wielokrotnie równolegle z różnymi projekcjami Q, K i V, co pozwala modelowi wychwytywać różne aspekty informacji.