Mi az az OOV-token és hogyan kezeli a subword-tokenizáció?
Machine Learning / AI
Mi a különbség a stemming és a lemmatizáció között? Melyik feladatnál melyiket alkalmazzuk?
Hogyan profilozzuk az LLM inferenciát GPU-n (nsight, torch profiler)?
Milyen kockázatai vannak az AutoML-nek az értelmezhetőség szempontjából?
Mi a több- és hiperspektrális felvételek?
Péntek, a munkanap végéig 2,5 óra van hátra. Egy üzleti ügyfél érkezik, és azt mondja, hogy hétfőn 9:30-kor találkozó van, és be kell fejezni egy feladatot, ami 5-6 órát vesz igénybe. Mit fogsz tenni?
Mi az a multi-armed bandit és hol használjuk őket az A/B tesztek helyett?
Mi az a redakció és a tokenizáció PII-ben adatgyűjteményekben?
A jelentkező kérdései a munkafolyamatról és a csapatról.
Mi az a Medusa és a multi-token előrejelzési fej?
Mi az a MIG (Multi-Instance GPU) az A100/H100-on?
Mi az a token, és miben különböznek a karakter-, szó- és al-szó szintű tokenizációk?
Mi az a középmező közelítés?
Az adatok lapos táblázatként voltak tárolva? Te magad fejlesztetted a funkciókat, vagy valaki más csinálta meg helyetted?
Mi az a videó objektum szegmentálás és maszk követés (XMem, SAM2)?
Mi a különbség a sparse retrieval (BM25) és a dense között?
Mi a célzott és a nem célzott támadás közötti különbség?
Milyen problémák merülnek fel instabil sorozatok előrejelzésekor (termékek hideg indítása)?
Mi az a confounder és hogyan vesszük figyelembe?
Mi azok a meta-tanulók (S-learner, T-learner, X-learner, R-learner)?