В каких случаях семантического поиска недостаточно для хорошего RAG и чем его дополнять?
Machine Learning / AI
Что такое аудиовердикты в модерации рекламы ВКонтакте?
Можно ли распараллелить обучение градиентного бустинга?
Что такое forced alignment и использовали ли вы его?
Как обеспечить воспроизводимость ML-эксперимента и возможность восстановить модель, если артефакт в S3 был удалён?
Чем отличается WAV от PCM?
Если у фраз различаются скорость речи и интервалы между словами, как это диагностировать и исправить?
Есть ли у вас дополнительные вопросы к интервьюеру?
Что делать, если у аудиосегментов нет транскриптов?
Что такое G2P?
После дообучения модель начала проглатывать слова. Как это диагностировать и исправить?
Что делать после сегментации VAD?
Почему в градиентном бустинге обычно используют слабые модели?
Есть ли опыт распределённого обучения и с чем именно?
Как версионировать данные для ML?
Можно ли построить бустинг на линейных моделях?
Что нужно сохранять в checkpoint, чтобы после падения через 47 часов продолжить обучение без потери состояния?
Какая асимптотическая сложность у self-attention и что такое KV-cache на инференсе?
Что такое нормализованный текст и как нормализовать обычный текст для TTS?
Как размечать неразмеченное аудио, если разные ASR по-разному нормализуют текст и ставят пунктуацию?