Какъв тип база данни да изберем за съхранение на събития от обаждания и защо?
Machine Learning / AI
Кои бизнес метрики и контрметрики трябва да се измерват за оценка на widget-а за промоция на продукти?
Коя е целевата променлива на n-тото дърво в градиентното буустинг?
Как да вземем предвид времевия интервал между покупките за релевантността на продуктите?
Как да увеличите скоростта на теста без повторно обучение на модела?
Коя метрика да изберем за регресия с изключения: MSE или MAE?
Как може да се настроят хиперпараметрите?
Към какъв приблизителен диапазон се ориентираш за прехода?
Разкажете за TF-IDF: как работи, как изглежда крайната матрица?
Защо аналитичната формула за линейната регресия не се използва на практика?
Как да използвате колаборативни методи за препоръки въз основа на ембедингите?
Коя функция за загуба (loss) се използва по подразбиране при линейната регресия?
Разкажете за регуляризацията в класическите алгоритми за ML: L1 и L2. Какви са техните свойства и разлики?
Какви критерии за разделяне се използват в дърветата за вземане на решения (например, критерий за ентропия)? Можете ли да назовете други?
Как ще настроим параметрите в градиентния буустинг? Какви параметри има и какво ще настройваш първо?
Каква е разликата между стохастичния градиентен спуск и класическия?
Защо трябва да използваме функцията LEAD за търсене на бъдещи стойности по id в SQL?
Как са устроени корутините и event loop в Python?
Какъв праг на грешка да използваме за спиране на обучението?