Machine Learning / AI
Какво може да се направи, ако разгръщаният агент отговаря твърде бавно или няма достатъчно памет за разполагане на LLM?
Защо тогава ще се обучава ранкерът? Тоест, той ще бъде независим от съдържанието — каква е неговата цел?
В кои случаи трябва да използвате корелацията на Спиърмън вместо Пиърсън?
Какви са характеристиките на класирането на стоките в електронната търговия (CTR, конверсия, доход)?
Как да направите многоезичен промпт устойчив на смяна на езика на въвеждане?
Как да оценим качеството на retrieval в RAG (recall@k, hit@k, MRR)?
Какъв е пълният процес на обучение на модела?
Как да решим проблема с липсата на необходима информация в данните?
Разкажи за опита си — кратка самопрезентация (5-7 минути).
Разкажете за ролята си и проектите в [организация] с три изречения: роля, ключово постижение, причина за напускане.
Какви трудности възникват при използването на Word2Vec и NLTK за руски език?
Как да проверите дали LLM-as-a-Judge правилно оценява качеството и как да го калибрирате?
Разкажете за идеята на Longformer и неговото разпръснато внимание.
Какво е OPQ и защо е по-добро от PQ?
Какво означава anchor в Triplet Loss?
Как изглежда типичният работен ден на разработчик?
Какво е DistilBERT? Какви са загубите на качество и печалбите от скоростта?
Какво е exponential backoff при опитите за повторно изпълнение в Airflow?
Как да създадем разделяне train/val/test и бенчмарк? Как правилно да разделим данните?
Как автоматично да разделите текста на смислови части без използване на LLM?