Machine Learning / AI
Каква е разликата между L1 и L2 регуляризацията в линейните модели?
Какво е Data Drift?
Какво е feature engineering за времеви серии (lags, ролинг статистики, datetime характеристики)?
Каква е алгоритмичната сложност на операциите за итерация и изтриване на възел в свързаните списъци?
Кои метрики са подходящи за оценка на качеството на модел за бинарна класификация?
Как влияе увеличаването на размера на партидата четири пъти върху скоростта на обучение и защо? Как работи обратното разпространение?
Какво е Earth Engine и какви задачи решава?
Каква е максималната вероятност да изтеглите бяла топка от случайно избрана кошница?
Как да организираме човешката оценка на LLM отговорите в екип?
Как влияе дълбочината на дървото върху качеството на модела и неговата способност за обобщаване?
Кои техники за компресиране на promptове знаете (LLMLingua)?
Ясно ли е това, с което се занимава компанията (обработка на отзиви на маркетплейси и геосервизи, анализ за партньори)?
Какво е BatchNorm?
Какви подходи има за тестване на ML модели в CI?
Какво е бюджет за търсене и как да го планираме?
Кои библиотеки за буустинг използвахте и защо?
Разкажете ни за bag-of-words и неговите ограничения.
В какво е ограничен pgvector в сравнение със специализираните VDB?
За какво е нужен Spark и как работи?
Какво са Informer и Autoformer?