Jak dělíme data pro křížovou validaci?
Machine Learning / AI
Můžete vysvětlit, jak funguje Early Stopping? Lze jej použít v klasickém strojovém učení?
Nasadil jsi své vlastní modely do výroby?
Jak se měří blízkost mezi vnořeními slov?
Jaké jsou metody klastrování experimentu (náhodné rozdělení do skupin)?
Takže jsi na žádném místě práce neměl end-to-end vývojový cyklus od sběru dat po prodej?
Jak se projevují slabé modely?
Jak zorganizovat automatické sběr dat a školení pomocí Airflow?
Proč opouštíte své současné zaměstnání?
Povězte mi o Random Forest: mechanika učení, jak jsou stromy vytvářeny, jak se provádí předpověď pro úlohy klasifikace?
Pracoval jste s Docker, MLflow, Airflow?
Jaká jsou omezení AutoML u velkých dat?
Povězte mi o normalizaci dávky: co to je a proč je to potřeba?
Jak implementovat logiku automatického odmítání hovorů při více než 10 hovorech za 15 minut od uživatele?
Co je to bagging?
Povězte nám o architektuře transformátoru: encoder-decoder, co se děje uvnitř dekodéru?
Proč má regulace L1 tendenci k nulování vah, zatímco L2 nikoliv? Jak se to matematicky odvozuje?
Jaké implementace gradient boosting znáš?
Jak funguje konvoluční vrstva?