Co je to délka kontextu a proč je těžké ji rozšířit?
Machine Learning / AI
Jaké techniky komprese promptů znáte (LLMLingua)?
Co je to přeučení a jak s ním bojovat?
Jaké jsou příčiny přeučení?
Jaké metody lze použít ke zlepšení modelu?
Jak odhadnout mediální dobu odezvy služby při velkém objemu logů, které se nevejdou do paměti?
Jak vybírat data pro odhad mediánu: sekvenční průchod nebo náhodný podvýběr?
Co je to autokorelace a částečná autokorelace (ACF, PACF)?
Jaké jsou typy regularizace a jak fungují?
Co je to experience replay buffer a k čemu slouží?
Proč se mohou váhy modelu stát velkými a proč je třeba je regulací snižovat?
Jak zorganizovat kontejnerizaci a nasazení modelů?
Co je Medusa a hlavy pro předpověď více tokenů?
Co je kalibrace a proč je důležitá pro spravedlnost?
Co je vizualizace feature space CV modelu pomocí t-SNE/UMAP?
Co je to skip spojení a k čemu je (ResNet)?
Povězte mi o úloze strojového překladu. Co je sequence-to-sequence?
V čem se liší MobileNet v2 od v1 (invertované reziduály)?
Jaké metody existují pro boj s přeučením a jak fungují?
Navrhněte systém OCR + NLP pro zpracování skenů smluv.