Machine Learning / AI
Jak zvýšit rychlost na testu bez opětovného tréninku modelu?
Co je NSP (predikce další věty) a proč se od ní RoBERTa odklonila?
Jaký je rozdíl mezi metrikami NDCG a Accuracy? Která je důležitější pro zpravodajský kanál?
Jak provést binarizaci faktorů, například věku?
Jaké metody lze použít pro generování obrázků (GAN, VAE, difuzní, autoregresivní)? Výhody a nevýhody každé z nich.
V čem se liší vzorkování top-k od vzorkování top-p (jádro)?
Jak by měl agent pracovat s velmi velkým schématem nástrojů (výběr funkcí)?
Co je NGBoost a pravděpodobnostní předpovědi?
Co je to bottleneck vrstva a k čemu se používá?
Co je CUPED a jak snižuje varianci?
Jaké jsou pasti AutoML v produkci (reprodukovatelnost)?
Co je DeepSpeed ZeRO Stage 1, 2, 3?
Proč nepracovat přímo s původní databází?
Co jsou chyby prvního a druhého druhu?
Setkali jste se někdy s datovým driftováním?
Co je to pravděpodobnostní programování (PyMC, Stan, NumPyro)?
Jak převést zpětnou vazbu uživatelů na metriku kvality služby?
Jak se bot obrací na model?
Co je generování kandidátů a jaké jsou přístupy (BM25, dense, hybrid)?
Co dělat, pokud se model nevejde na GPU při dalším tréninku?