Какво е дължината на контекста и защо е трудно да я разширите?
Machine Learning / AI
Кои техники за компресиране на promptове знаете (LLMLingua)?
Какво е пренасищане и как да се борим с него?
Какви са причините за пренасищане?
Какви методи могат да се използват за подобряване на модела?
Какво е автокорелация и частична автокорелация (ACF, PACF)?
Как да оценим медианното време за отговор на услугата при голям обем логове, които не се побират в паметта?
Как да избираме данни за оценка на медианата: последователен проход или случайна подвыборка?
Какви видове регуляризация има и как работят?
Какво е буфер за повторно възпроизвеждане на опит и защо е необходим?
Защо теглата на модела могат да станат големи и защо е необходимо да ги намаляваме с регуляризация?
Какво е визуализацията на feature space на CV модел с t-SNE/UMAP?
Какво е калибриране и защо е важно за справедливостта?
Как да организираме контейнеризацията и разгръщането на модели?
Какво е Medusa и много-токен предсказателни глави?
Какво е NCCL и за какво отговаря?
Разкажете за задачата за машинен превод. Какво е sequence-to-sequence?
Как да тествате LLM агент (детерминирани тестове, повторно възпроизвеждане, имитиращи инструменти)?
Какви видове грешки има в медицинските протоколи и как се типизират?
Проектирайте система OCR + NLP за обработка на сканирани договори.