Machine Learning / AI
Jak využít vyhledávací dotaz a historii uživatele k tvorbě výstupu při studeném startu?
Jak zorganizovat sledování modelu v produkci?
Proč funguje bagging s stromy, jako v náhodném lese?
Podle jakého kritéria spojovat tabulky v SQL?
Jak vybrat práh pro automatické odmítnutí a práh pro ruční moderaci v úloze moderace inzerátů?
Jak implementovat řazení podle data s přesností na milisekundy v SQL?
Jak používat kategorie produktů k tvorbě relevantních doporučení?
Co je to kontejnerizace a k čemu je potřeba?
Jak je v Dockeru realizováno rozdělení zdrojů?
Proč se při řešení úlohy lineární regrese ne používá analytický vzorec?
Jak funguje Random Forest?
Co jsou bias a variance, a co se snižuje v náhodném lese?
Jak dělíme data pro křížovou validaci?
Na co si dát pozor při optimalizaci SQL dotazu?
Uveďte klasické způsoby získávání embedování slov (Word2Vec, FastText, TF-IDF, N-gramy atd.).
Jak řešit situaci, když je jeden produkt prodáván různými prodejci?
Jak fungují hash join a merge join?