Middle — Senior
LoRA эмне жана ал эмне үчүн иштейт (төмөн ранг гипотезасы)?
sobes.tech AI
AIден жооп
LoRA (Low-Rank Adaptation) — бул чоң тил моделдерин (LLM) такташтын бир жолу, ал моделди жаңы тапшырмаларга натыйжалуу ылайыкташтыруу үчүн минималдуу ресурстарды талап кылат.
Идея төмөн-ранг гипотезасына негизделген: чоң моделдин салмактарындагы өзгөрүүлөр адаптация учурунда төмөн-ранг матрицалар менен жакындатыла алат. Бардык параметрлерди жаңылоонун ордуна, LoRA бар болгон салмактарга кичинекей төмөн-ранг матрицаларды кошуп, алардын үстүндө үйрөтөт.
Бул параметрлердин санын жана сактоо үчүн керектүү эс тутумду кыйла азайтат, сапаты жана ийкемдүүлүгүн сактап калуу менен.
Мындан ары, бул так иштейт:
# W — баштапкы салмак матрицасы деп эсептейли
# LoRA эки төмөн-ранг A жана B матрицаларын кошот
# Жаңыланган салмактар: W' = W + B @ A
# Окутуу учурунда, гана A жана B жаңыланат, W өзгөрбөйт
Ошентип, LoRA чоң моделдерди тез жана натыйжалуу ылайыкташтыруу мүмкүнчүлүгүн берет, толук кайра окутууну талап кылбайт.