Co je to operátor HAVING v SQL? Kde se používá?
Machine Learning / AI
Úloha regresní: předpověď ceny akcií na 5. rok na základě dat za 4 roky pomocí boostingu. Jakou chybu jsme udělali?
Co jsou metriky MAPE a SMAPE? Kde mohou být neúčinné?
Povězte nám o projektu hodnocení kvality práce dispečerů: jaké modely byly použity, jak byly srovnávány s referenčním skriptem?
Proč CatBoost a ne XGBoost nebo LightGBM? Čím se liší?
Úkol MVP: binární klasifikace s nerovnováhou tříd, data jsou rozdělena na 10 strojů, je zde textová vlastnost. Milyen megközelítést javasolna?
Povězte nám o projektu seskupování požadavků s označením podle obchodní důležitosti.
Které metriky jsou při velké nerovnováze tříd (99 ku 1) nejdůležitější?
Znáte protokoly HTTP, UDP, TLS?
Jaký je hlavní rozdíl mezi Spark a Pandas? Co je Hadoop?
Víte, co je bagging? Uveďte příklad algoritmu.
Co je LoRA (Low-Rank Adaptation)?
Řekněte mi více o projektu předpovědi odchodu zaměstnanců: co jste dělali, jaká data jste použili, proč jste zvolili CatBoost?
Povězte o algoritmu K-means a jeho pokročilých variantách (K-means++).
Povězte nám o sobě, svých zkušenostech a projektech.
Jaké metriky se používají k hodnocení kvality shlukování? Jak vybrat počet shluků?