Machine Learning / AI
Co je TF-IDF?
Co je to drift rozdělení a jak ho odhalit (KS-test, PSI)?
Jak určit derivaci funkce ztráty pro logloss a MSE?
Který dotaz funguje rychleji v sloupcové databázi a který v řádkové?
Co je BLEU a v jakých úlohách se používá? Jaké jsou problémy této metriky?
Co jsou spectral GNN a spatial GNN?
Jak ověřit kvalitu doporučení bez rozdělení dat na trénink a test?
Co je to vzdálený dohled (NER z KB)?
Jak pracovat s neúplnými daty z různých serverů a tabulek?
Byl proveden dropout založený na ztrátě nebo náhodném vyřazení vah?
Co je to model ARIMA a co znamenají jeho parametry (p, d, q)?
Co je to kolaps normy v embeddingách a jak ho odhalit?
Co zahrnuje pipeline MLOps od tréninku po prodej?
Jak setřídit seznam párů podle druhého prvku v Pythonu?
Existují omezení kvůli práci s osobními údaji?
Co předpovídá U-Net ve Stable Diffusion při každém kroku?
Jaké jsou metody klastrování experimentu (náhodné rozdělení do skupin)?
Co je Textual Inversion a čím se liší od LoRA?
Jak funguje TF-IDF?
Co je to apriorní a aposteriorní rozdělení?