Czym jest token OOV i jak radzi sobie z nim tokenizacja subword?
Machine Learning / AI
Czym różni się stemming od lematyzacji? W jakich zadaniach stosować które?
Jak profilować inferencję LLM na GPU (nsight, torch profiler)?
Jakie są ryzyka AutoML z punktu widzenia interpretowalności?
Czym są zdjęcia multispektralne i hiperspektralne?
Czym są multi-armed bandits i gdzie ich używać zamiast testów A/B?
Czym jest redakcja i tokenizacja PII w zbiorach danych?
Piątek, do końca dnia pracy pozostały 2,5 godziny. Przyjeżdża klient biznesowy i mówi, że w poniedziałek o 9:30 jest spotkanie i trzeba dokończyć zadanie, które zajmie 5-6 godzin. Co zrobisz?
Pytania kandydata dotyczące formatu pracy i zespołu.
Czym jest MIG (Multi-Instance GPU) na A100/H100?
Czym jest Medusa i wielo-tokenowe głowy predykcji?
Czym jest token i czym różni się tokenizacja na poziomie znaku, słowa i podwyrazu?
Czym jest przybliżenie pola średniego?
Czy dane były przechowywane w formie płaskiej tabeli? Czy sam opracowywałeś funkcje, czy ktoś inny to robił za ciebie?
Czym jest atak ukierunkowany vs nieukierunkowany?
Jakie problemy występują przy prognozowaniu niestabilnych serii (cold start produktów)?
Czym jest segmentacja obiektów wideo i śledzenie masek (XMem, SAM2)?
Jakie są metody pracy z bardzo rozrzedzonymi danymi?
Czym różni się wyszukiwanie rzadkie (BM25) od gęstego?
Czym są meta-uczniowie (S-learner, T-learner, X-learner, R-learner)?