Sobes.tech

Machine Learning / AI

Как да оценим качеството на ретривъра? От къде да вземем колекция от документи за оценка на метриките?

369

Каква е разликата между Tensor Parallel Size и Data Parallel Size в vLLM?

185

Имаш малък набор от данни с рецензии за филми на руски език и техните бинарни етикети за тоналност (етикети: 0 — негативен, 1 — позитивен). Задачата ти е да реализираш пълен pipeline за обучение на прост модел за класификация на текст без използване на готови енкодери като BERT за 15 минути и да покажеш точността (accuracy) върху тези данни. reviews = [ "Този филм е просто невероятен!", "Ужасна игра на актьорите и скучен сюжет.", "Много ми хареса всеки момент!", "Най-лошият филм, който съм виждал.", "Отлична режисура и чудесна история.", "Невъзможно скучно и предсказуемо." ] labels = [1, 0, 1, 0, 1, 0]

183

Кой параметър в модела за вграждане определя максималния брой токени на входа? Какво ще се случи, ако подадете повече токени от лимита?

168

Как влияе увеличаването на размера на партидата четири пъти върху скоростта на обучение и защо? Как работи обратното разпространение?

163

Как се извличат данните от векторната база по потребителски заявка?

153

Какво е квантизация на модела и какво се случва с теглата при нейното прилагане в vLLM?

153

Какво ще се случи, ако подадете в LLM контекст от 120 000 токена при лимит 60 000?

151

Как беше организирано търсенето на информация във векторната база? Защо използвахте Qdrant?

141

Какво е LangGraph, за какво се използва, как се реализират клонове и условни преходи? В какво се различават инструментите от възлите?

140