Machine Learning / AI
-- 1.1 Какво ще покаже заявката: SELECT campaign, COUNT(*) as rows, COUNT(DISTINCT co.user_id) AS users FROM campaigns AS ca INNER JOIN communications AS co ON ca.campaign = co.campaign GROUP BY ca.campaign AS campaign -- 1.2 Как ще се промени отговорът, ако промените типа на JOIN на LEFT? -- 1.3 Посочете реда на изпълнение на операторите в тази заявка. -- 2. Таблицата campaigns беше коригирана: премахнати са дублиранията, добавен е ключ (PK). -- Проведени са повече кампании, поради грешки, потребителите започнаха да получават неуспешни опити за доставка на комуникации, а някои изобщо не успяха да бъдат показани. -- Пример 1: communications -- | user_id | campaign | status | -- | 1000001 | promo_cats | error | -- | 1000001 | promo_cats | error | -- | 1000001 | promo_cats | success| -- | 1000001 | promo_cats | success| -- | 1000001 | promo_cats | error | -- Пример 2: communications -- | user_id | campaign | status | -- | 1000002 | promo_rats | error | -- | 1000002 | promo_rats | error | -- | 1000002 | promo_rats | error | -- | 1000002 | promo_rats | error | -- | 1000002 | promo_rats | error | -- За изпратените промо кампании към потребителите: -- 2.1 Напишете заявка, която показва броя на потребителите, които успешно са получили комуникация, за всяка кампания. -- 2.2 Променете заявката, за да показва: броя на потребителите, които не са получили нито една успешна комуникация, за всяка кампания.
Разкажете за пълния цикъл на въвеждане на продукт на нов пазар в [компания]: какво разбирате под пълния цикъл, какви етапи, метрики, резултати
Колко време е необходимо за започване на нов проект?
Какво още, освен крос-ентропия, може да се използва като функция на загубата?
Разкажете за себе си и своя релевантен опит.
Разкажи за основната архитектура на трансформатора, какви са основните части.
Има ли определена методология за разработка (Agile, Scrum, Kanban)?
Защо CatBoost, а не XGBoost или LightGBM? Какви са разликите?
Задача по регресия: предсказване на цената на акциите за 5-ия година въз основа на данни за 4 години с помощта на бустинг. Каква грешка направихме?
Кога да изберете LoRA и кога retrieval по подобни постове? Колко данни са необходими за всеки подход?
Как протече процесът на преход към ML/Data Science? Имаше ли курсове или беше самообучение?
Разкажи за проекта за откриване на спам в лийдовете и оптимизацията на работата на кол центъра.
Защо напуснахте последната си работа?
Можете ли да обясните как работи Early Stopping? Може ли да се приложи в класическото машинно обучение?
Колко време работиш от разстояние?
Защо ReLU е толкова популярна?
Как да обърнем масив без използване на компилация?
Как се обработваха пиковете на натоварване в системата RAG? Какво се случваше при високо натоварване?
Агентът никога не извиква един от трите инструмента. Как да изследваме и решим този проблем?
Имаш ли военен билет или приписно?