Какая сложность алгоритмов зависит от n или k и от чего она зависит?
Machine Learning / AI
Что такое CTC loss в OCR?
Что такое TPR и FPR? Как они связаны с precision и recall?
Как случайный лес уменьшает влияние отдельных деревьев на итоговое предсказание?
Какие альтернативы CLIP (SigLIP, EVA-CLIP)?
В чём разница self-attention и cross-attention, для чего используется каждый?
Как из текста получить эмбеддинги, которые пойдут на вход в трансформер?
Расскажите про multi-head attention в деталях: что такое Q/K/V, как считаются веса внимания, зачем несколько голов.
Как оценить качество ретривала? Откуда взять коллекцию документов для оценки метрик?
Как использовать BERT в QA-задаче SQuAD-стиля?
Какие проблемы у функции активации Sigmoid? Где она применяется и как интерпретируется?
Как понять, что модель недообучена или переобучена?
Что такое Dropout и как он ведёт себя на train и на inference?
Что такое OOV-токен и как с ним борется subword-токенизация?
Какая метрика важнее: precision или recall в зависимости от задачи?
Какие требования EU AI Act к high-risk системам?
Как найти в строке максимальное целое число без использования регулярных выражений на Python?
Понимают ли модели Hugging Face короткие аббревиатуры?
Что такое градиентный бустинг? Где там появляется градиент?
Какие современные TTS-модели (Tortoise, XTTS, StyleTTS2, ElevenLabs)?