Machine Learning / AI
Кои метрики за справедливост разглеждахте в продукцията?
Какви критерии за спиране на растежа на дървото съществуват освен ограничението на дълбочината?
Как да профилираме консумацията на енергия при ML inference?
Разкажете ни за архитектурата на BERT и как е обучен.
Какви проблеми възникват, ако батч нормализацията актуализира статистиките по време на валидирането?
Диалозите бяха с различна дължина — как работи с това? Всички разговори ли се побираха в контекстното прозорец?
Как оценихте готовността на системата за класификация на билетите за поддръжка за внедряване?
Какво има на изхода на реаранкера?
Разкажи ми за хибридното извличане в RAG — кой модел избра за плътните вектори?
Разкажи за тестването (smoke, функционално, e2e)
Защо теглата на модела могат да станат големи и защо е необходимо да ги намаляваме с регуляризация?
Каква е разликата между GraphRAG и vector RAG?
Какви метрики се използват за сегментация и детекция на обекти?
Кое работи по-бързо: count(*) или count(име_на_колоната)?
Кои са капаните при сравняване на мултимодални модели на бенчмаркове?
Какво е нормализирането на дължината на документа?
Как да използвате филтрите за метаданни във векторната база?
Какво е Mixture of Experts (MoE) и какви са неговите предимства и недостатъци?
Как да добавите нов източник на данни с кратка история в логистичната регресия?
Защо не може да се решат всички задачи с класически методи?