Sobes.tech
Senior

Pastāsti man par LoRA: kas tas ir, kā tas tiek apmācīts un kā tas darbojas inferencē?

sobes.tech AI

Atbilde no AI

LoRA (Zema ranga pielāgošana) ir metode, kas ļauj lielas neironu tīklus pielāgot, apmācot tikai nelielu parametru skaitu, kas ļauj efektīvi veikt modeļu tālāku apmācību bez pilnīgas pārprogrammēšanas.

Kā tas darbojas:

  • Oriģinālajā modelī slāņa svari tiek attēloti kā matricās.
  • LoRA pievieno šīm matricām zema ranga korekcijas (dalīšana divās mazās matricās).
  • Apmācības laikā tiek atjauninātas tikai šīs zema ranga matricas, bet oriģinālie svari paliek fiksēti.

Apmācība:

  • Apmācās tikai neliels parametru skaits, kas samazina resursu un laika prasības.
  • Ļauj ātri pielāgot modeli jauniem uzdevumiem vai datiem.

Inferencē:

  • Inferencē LoRA matricu korekcijas tiek summētas ar oriģinālajiem svariem, radot pielāgotu modeli.
  • Tas nedaudz palielina aprēķinus, bet saglabā efektivitāti un kompakti.

To var iedomāties šādi: ja oriģinālais svaru matrica ir W, tad galīgais svars pēc LoRA ir W + BA, kur B un A ir zema ranga matricas, kuras tiek apmācītas atsevišķi.