Machine Learning / AI
Co je PatchTST?
Co je MIG (Multi-Instance GPU) na A100/H100?
Co je to feature engineering pro časové řady (zpoždění, klouzavá statistika, vlastnosti data/time)?
Jakou závislost mezi proměnnými hledá koeficient korelace Pearson?
Jaké hyperparametry HNSW jsou důležité (M, efConstruction, efSearch)?
Jaké problémy vznikají při spojování funkcí s historií?
Co je to Conditional Edge?
Na co je ve Datasetu __len__? Proč potřebujeme znát délku?
Jaký je rozdíl mezi sémantickou segmentací, segmentací instancí a detekcí objektů?
Jak zohlednit případy s nulami v součinu prvků seznamu?
Co je TF-IDF?
Co je to drift rozdělení a jak ho odhalit (KS-test, PSI)?
Jak určit derivaci funkce ztráty pro logloss a MSE?
Co je to popularita-bayas a jak s tím bojovat?
Který dotaz funguje rychleji v sloupcové databázi a který v řádkové?
Co je BLEU a v jakých úlohách se používá? Jaké jsou problémy této metriky?
Co jsou spectral GNN a spatial GNN?
Jak ověřit kvalitu doporučení bez rozdělení dat na trénink a test?
Co je to vzdálený dohled (NER z KB)?
Ještě je trochu času — zkuste zkusit optimalizovaně přepsat řešení ROC-AUC (pomocí třídění a rangů v O(n log n))?