Machine Learning / AI
Cum se schimbă bias-ul, variația și supraînvățarea odată cu creșterea numărului de copaci în pădurea aleatorie și în boosting?
Povestiți-ne despre proiectul de evaluare a calității muncii dispecerilor: ce modele au fost utilizate, cum au fost comparate cu scriptul de referință?
Dată fiind o șir de caractere care conține litere și cifre. Găsiți cel mai mare număr care apare în șir (considerând cifrele consecutive ca un singur număr).
De ce regularizarea L1 zeroază greutățile? Explicați mecanismul.
Ce se poate face pentru ca modelul să nu răspundă dacă în context nu există informații pentru a răspunde la întrebare?
Ce model a fost obținut în proiectul de retenție, câte caracteristici avea și care era dimensiunea eșantionului?
Cum se depanează acțiunile agenților în sistemele multi-agent?
Există o metodologie de dezvoltare specifică (Agile, Scrum, Kanban)?
De ce CatBoost, și nu XGBoost sau LightGBM? Care sunt diferențele?
Când să alegi LoRA și când retrieval pe postări similare? Cât de multe date sunt necesare pentru fiecare abordare?
Știi ce este bagging? Oferă un exemplu de algoritm.
Vorbește despre experiența ta în contextul poziției de Data Scientist.
Ce este RAG și care sunt componentele sale principale?
Vorbește-mi despre tipurile de codare pozițională, în special despre Rotary Positional Encoding (RoPE).
A fost sub forma unui test/pilot sau a mers direct în producție și au folosit-o managerii?
Vorbește despre proiectul de detectare a spamului în lead-uri și de optimizare a muncii call-center-ului.
De ce ați părăsit ultimul loc de muncă?
De cât timp lucrezi de la distanță?
Cum să nu strici producția la implementarea unei versiuni problematice care va porni, dar va funcționa cu erori?
Ce se poate face atunci când, după o muncă îndelungată, contextul agentului se umple treptat?