Machine Learning / AI
Proč lze pro klasifikaci použít rozhodovací strom?
Jak Tableau funguje z hlediska sběru dat: samostatně nebo přes připojení k datovému skladu?
Jak udělat vícejazyčný prompt odolný vůči změně jazyka vstupu?
Co je RVQ (reziduální vektorová kvantizace) v audio kodeku?
Která metoda HTTP je lepší pro získání dat podle telefonního čísla: GET nebo POST?
Co je to skip spojení a k čemu je (ResNet)?
Jak řešit problém s chybějícími potřebnými informacemi v datech?
Jaký mechanismus ladění modelu použít?
Co jsou A100, H100, B200 a jaké jsou hlavní architektonické rozdíly?
Co je RNN-T (transducer) a jakou má výhodu pro streaming?
Jaké metody průzkumu znáte (epsilon-greedy, UCB, Thompson, vnitřní motivace)?
Co je stacking a blending? Jak se vyhnout leakage ve stackingu?
Jak vypadá typický pracovní den vývojáře?
Jak strukturovat práci od formulace úkolů?
Jak chránit RAG před injekcí promptů a nechtěným obsahem?
Uveďte několik typů metrik klasifikace a vysvětlete je.
Pokud je AUC nového modelu 0,82 oproti 0,80 u starého modelu, můžeme s jistotou říct, že je nový lepší? Jak ověřit statistickou významnost?
Povězte nám o architektuře transformátoru: encoder-decoder, co se děje uvnitř dekodéru?
Co je GraphSAINT?
Nahrál jste do úložiště obrázek s Dockerfilem pro nasazení modelu?