Machine Learning / AI
Какви проблеми възникват при липса на случайни данни?
Каква е разликата между batch normalization и layer normalization? Кога да използваме коя?
Какво е cross-encoder и къде сте го използвали?
Кои рамки се използват за KG (Neo4j, Stardog, Amazon Neptune)?
В кои области работихте с ML? Трябваше ли да тренирате модели и ако да, какви архитектури?
Колко инструмента имаше у ReAct-агента?
Какво е методът next при итераторите и как се реализира?
На какво да стартирам LLM локално за бизнес система?
Какво да правите, ако заявката изобщо не се отнася към нито един сценарий (например, 'здравей' или спам)?
Как работят дърветата за вземане на решения и какво се случва при липса на ограничения?
Разкажи за модела за оценка на пазарната стойност на недвижимите имоти: същността, данните, приложението.
Предложете вариант за разработване на система за препоръки на задачи за ученик на образователна платформа.
Какво е хибридно търсене в Qdrant и как да комбинираме dense + sparse?
Разкажи ми за параметрите на генериране на LLM: температура, top-k, top-p и други.
Трябва ли да се регуларизира свободният член (bias, w0)? Защо изобщо е необходим w0?
Разкажи за опита си в 1C-Rarus, обработка на заявки в Service Desk. Това ли е помощен център за клиенти?
Как да проектираме система за съхранение и търсене за 10 000 Telegram канала с 300 000 публикации на ден, с латентност по-малка от 2 секунди?
Разкажи накратко за екипа, в който си работил в [компания].
Защо избрахте хибридното търсене BM25 + embeddings вместо само косинусното разстояние?
Разкажи за разликата между мултитрейдинг, мултипроцесорност и асинхронност