რა გამოიყენეს RAG-ში ინდექსის შექმნისთვის?
Machine Learning / AI
რა უნდა გააკეთოთ ტრენინგის ბოლოს?
რა არის მონაცემთა პარალელიზმი და მოდელის პარალელიზმი?
როგორ გამოვიტანოთ შედეგების სია?
ROC-AUC სხვა მეტრიკებიდან რა განსხვავებაა?
რა არის sparse attention?
რა მნიშვნელობა აქვს anchor-ს Triplet Loss-ში?
Margin Loss და Triplet Loss შორის რა განსხვავებაა?
რა არის ეპოქა (epoch)?
რა არის n ყურადღების სირთულის კონტექსტში;
როგორ იძლევა რერანკერი?
თუ არ არსებობს მითითებული პასუხები, მხოლოდ დოკუმენტები და კონტექსტია — როგორ შევაფასოთ სისტემა და საიდან მივიღოთ მითითებული პასუხი?
რა ტიპის ოპტიმიზაცია არსებობს LLM-ის?
რა კიდევ შეიძლება გამოყენებულ იქნას დანაკარგის ფუნქციად კროს-ენტროპიის გარდა?
რა შეიცვალა LLM-ში ორიგინალ ტრანსფორმატორთან შედარებით?
რომელი ყურადღების ტიპი საშუალებას იძლევა სირთულე ო(ნ²)-ზე დაბლა დაიყვეს?
რა არის gradient checkpointing?
რა არის კვანტიზაცია?
როგორ შევაფასოთ RAG-ის განხორციელება შემსრულებელი აგენტი?
თუ დეკოდერს 10k ტოკენის სიგრძის სერია მიაწოდეთ, ხოლო მოდელი 9k-ზე იყო სწავლული, რა მოხდება?