Jak rozdělit dokumenty na části? Jakou velikost části obvykle volí?
Machine Learning / AI
Zajímá vás pouze RAG nebo obecně Data Science? Zajímá vás oblast boje proti podvodům?
Jak sloučit data ze dvou tabulek s různou úplností adresy a ceny v SQL?
Jaká je časová složitost řešení v notaci O?
Jak zorganizovat detekci anomálií podle metrik modelu?
Jaká hloubka stromů se používá v Random Forest a boosting?
Jak řešíme problém lineární regrese, pokud nepoužíváme explicitní vzorec?
Jaké metody existují pro boj s přeučením a jak fungují?
Jak se změní ROC AUC při duplikaci pozitivních a negativních objektů a proč?
Jaký je rozdíl mezi gradient boostingem a náhodným lesem?
Povězte mi o optimalizátoru Adam: z čeho se skládá?
Jaký je rozdíl mezi AutoML pro tabulární data a CV/NLP?
Jak vytvořit metriku, která zohledňuje očekávaný zisk a pravděpodobnost prodeje podle kategorií?
Povězte mi o Dropoutu: jak funguje během tréninku a co se s ním děje při inferenci?
Jak zjednodušit řešení, aby se prošlo seznamem méněkrát?
Co je to 3D paralelismus (data + tensor + pipeline)?
Co je stacking a blending?
Jak filtrovat pouze aktuální data v SQL dotazu?
Co je SwiGLU a v jakých modelech se používá tato aktivace?
Jak zohlednit různé náklady na klik v různých kategoriích produktů?