Ce este un token OOV și cum se ocupă subword-tokenizarea de acesta?
Machine Learning / AI
Care este diferența dintre stemming și lematizare? În ce sarcini se aplică fiecare?
Cum se profilează inferența LLM pe GPU (nsight, torch profiler)?
Ce sunt imaginile multispectrale și hiperspectrale?
Care sunt riscurile AutoML din punctul de vedere al interpretabilității?
Vineri, mai sunt 2,5 ore până la sfârșitul zilei de lucru. Vine un client de afaceri și spune că luni la ora 9:30 are o întâlnire și trebuie finalizată o sarcină care durează 5-6 ore. Ce vei face?
Ce sunt multi-armed bandits și unde să îi folosiți în loc de teste A/B?
Ce este redactarea și tokenizarea PII în seturile de date?
Ce este MIG (Multi-Instance GPU) pe A100/H100?
Ce este un token și în ce constă diferența dintre tokenizarea la nivel de caracter, cuvânt și subcuvânt?
Ce este aproximația de câmp mediu?
Întrebări ale candidatului despre formatul de lucru și echipă.
Ce este Medusa și capetele de predicție multi-token?
Ce sunt meta-învățători (S-learner, T-learner, X-learner, R-learner)?
Ce este un atac țintit vs atac nespecificat?
Ce probleme apar apar la previzionarea seriilor instabile (cold start al produselor)?
Datele au fost stocate sub formă de tabel plat? Tu ai dezvoltat singur funcțiile sau altcineva le-a făcut pentru tine?
Ce tehnici se folosesc pentru a lucra cu date foarte rarefiate?
Care este diferența dintre recuperarea sparse (BM25) și dense?
Ce este înțelegerea documentelor fără OCR (Donut, Pix2Struct)?