Čo je OOV token a ako sa s ním vysporiada subword-tokenizácia?
Machine Learning / AI
V čom sa líši stemming od lematizácie? V ktorých úlohách sa má použiť ktorý?
Ako profilovať inferenciu LLM na GPU (nsight, torch profiler)?
Aké sú riziká AutoML z hľadiska interpretovateľnosti?
Čo sú to multispektrálne a hyperspektrálne snímky?
Čo sú multi-armed bandits a kde ich použiť namiesto A/B testov?
Čo je redakcia a tokenizácia PII v dátových sadách?
Piatok, do konca delovnega dne je ostalo 2,5 ure. Pride poslovni stranka in pove, da je v ponedeljek ob 9:30 sestanek in da je treba dokončati nalogo, ki traja 5-6 ur. Kaj boš naredil?
Otázky kandidáta o formáte práce a tíme.
Čo je MIG (Multi-Instance GPU) na A100/H100?
Čo je Medusa a multi-token predikčné hlavy?
Čo je token a v čom sa líši tokenizácia na úrovni znaku, slova a podslova?
Čo je aproximácia stredného poľa?
Dáta boli uložené vo forme plochej tabuľky? Vyvíjal si funkcie sám alebo ich za teba niekto iný?
Čo je to cielený vs. nek cílený útok?
Čo je confounder a ako ho zohľadniť?
Aké problémy sa vyskytujú pri prognóze nestabilných radov (cold start produktov)?
Čo je segmentácia videových objektov a sledovanie mášok (XMem, SAM2)?
Čo je rozdiel medzi sparse retrieval (BM25) a dense?
Čo sú meta-učitelia (S-learner, T-learner, X-learner, R-learner)?