Sobes.tech
Middle — Senior

Mis on LoRA ja miks see töötab (madala rühma hüpotees)?

sobes.tech AI

Vastus AI-lt

LoRA (Low-Rank Adaptation) on meetod suurte keelemudelite (LLM) peenhäälestamiseks, mis võimaldab mudelit tõhusalt kohandada uute ülesannete jaoks minimaalsete ressurssidega.

Idee põhineb madala ranga hüpoteesil: suure mudeli kaalude muutused adaptsiooni ajal võivad olla ligikaudu esindatud madala ranga maatriksitega. Selle asemel, et uuendada kõiki mudeli parameetreid, lisab LoRA olemasolevatele kaaludele väikeseid madala ranga maatrikseid ja õpib ainult neid.

See vähendab oluliselt õppitavate parameetrite arvu ja mälu, mis on vajalik kohandatud mudeli salvestamiseks, säilitades samal ajal kvaliteedi ja paindlikkuse.

Umbes nii see töötab:

# Oletame, et W on algne kaalumaatriks
# LoRA lisab kaks madala ranga A ja B maatriksit
# Uuendatud kaalud: W' = W + B @ A

# Treeningu ajal uuendatakse ainult A ja B, W jääb fikseerituks

Sel viisil võimaldab LoRA kiiresti ja tõhusalt kohandada suuri mudeleid ilma täieliku uuestiõppeta.