Co je to 3D paralelismus (data + tensor + pipeline)?
Machine Learning / AI
Co je stacking a blending?
Jak vytvořit metriku, která zohledňuje očekávaný zisk a pravděpodobnost prodeje podle kategorií?
Jak určit, že zboží bylo zakoupeno spolu a jsou doplňkové?
Jak trénovat na velkém dávce s omezenou pamětí?
Proč se při aktualizaci vah používá porovnání s epsilonem?
Co je to gradient boosting?
Co je Elastic Net?
Jak zajistit bezpečnost dat při RAG (PII, přístupová práva)?
Povězte o metodách regularizace a boje s přeučením v Deep Learningu (Dropout, Batch Normalization, Early Stopping, Elastic Net).
Co je to agregace sousedství a jaké funkce se používají (průměr, součet, max, LSTM)?
Jak zobrazit aktuální adresu a cenu pro každé inzerát v SQL?
Jak efektivně hledat podobné embeddingy mezi miliony produktů pomocí Faiss nebo jiných indexů?
Jaké metody regularizace existují pro nelineární modely?
Jak zvýšit rychlost na testu bez opětovného tréninku modelu?
Jaká je cílová proměnná u n-tého stromu v gradientovém boostingu?
Jaké jsou moderní přístupy k tabulkovým datům (CatBoost, LightGBM, XGBoost, deep tabular)?
Jaký typ databáze zvolit pro ukládání událostí hovorů a proč?