Machine Learning / AI
Jaká je asymptotická složitost při několika průchodech seznamem?
Jak funguje náhodný les a jak se trénuje v úloze klasifikace?
Je třeba regularizovat volný člen (bias, w0)? K čemu je vůbec w0 potřeba?
Jak změřit kvalitu modelu binární klasifikace? Jaké metriky znáte?
Lze levně opravit problém s použitím modulu v gradientním sestupu?
Co je H(X) v kontextu klasifikace, například entropie?
Lze považovat nový model s F1 skóre 0,81 za lepší než model s 0,8 a ihned ho nasadit do produkce?
Jak porovnat souřadnice s plovoucí desetinnou čárkou s ohledem na vlastnosti float v různých jazycích?
Pokud je AUC nového modelu 0,82 oproti 0,80 u starého modelu, můžeme s jistotou říct, že je nový lepší? Jak ověřit statistickou významnost?
Co je to ROC křivka?
Co je to kritérium větvení v stromech?
Čím se zabýváte ve volném čase?
Jak popsat architekturu modelu náhodného lesa s přidaným lineárním modelem pro extrapolaci?
Jak se chovají Precision a Recall při nerovnováze tříd? Příklad: 95 jednotek a 5 nul, model vždy předpovídá 1.
Co je to model jazy Unigram v tokenizaci (jako v SentencePiece)?
Jak implementovat kontrolu klíčů s zápornými a shodnými hodnotami pro zrcadlové body?