Как да оценим качеството на ретривъра? От къде да вземем колекция от документи за оценка на метриките?
Machine Learning / AI
Какво е vLLM и за какво се използва?
Каква е разликата между Tensor Parallel Size и Data Parallel Size в vLLM?
Имаш малък набор от данни с рецензии за филми на руски език и техните бинарни етикети за тоналност (етикети: 0 — негативен, 1 — позитивен). Задачата ти е да реализираш пълен pipeline за обучение на прост модел за класификация на текст без използване на готови енкодери като BERT за 15 минути и да покажеш точността (accuracy) върху тези данни. reviews = [ "Този филм е просто невероятен!", "Ужасна игра на актьорите и скучен сюжет.", "Много ми хареса всеки момент!", "Най-лошият филм, който съм виждал.", "Отлична режисура и чудесна история.", "Невъзможно скучно и предсказуемо." ] labels = [1, 0, 1, 0, 1, 0]
Какво е RAG и какъв основен проблем решава?
Кой параметър в модела за вграждане определя максималния брой токени на входа? Какво ще се случи, ако подадете повече токени от лимита?
Как влияе увеличаването на размера на партидата четири пъти върху скоростта на обучение и защо? Как работи обратното разпространение?
Разкажи ми за себе си и опита си
Какво е модел на вграждане и какво е токен?
Как се извличат данните от векторната база по потребителски заявка?
Какво е квантизация на модела и какво се случва с теглата при нейното прилагане в vLLM?
Какво ще се случи, ако подадете в LLM контекст от 120 000 токена при лимит 60 000?
Как беше организирано търсенето на информация във векторната база? Защо използвахте Qdrant?
Какво е LangGraph, за какво се използва, как се реализират клонове и условни преходи? В какво се различават инструментите от възлите?