Machine Learning / AI
Cum influențează Random Forest biasul și variația?
Ce tip de chunking s-a folosit și ce tip de documente erau (Word, PDF, Excel etc.)?
Cum funcționează o interogare SQL cu un set complet de câmpuri fără funcții de agregare și GROUP BY pe aceleași câmpuri?
Care este motivația principală pentru a lua în considerare alte opțiuni de muncă?
Ce este ACID?
Ce te inspiră la locul de muncă?
Vorbește despre sarcina de clasificare a solicitărilor de suport pentru prioritizare.
Care sunt caracteristicile proiecțiilor geospatiale (UTM, EPSG, WGS84)?
Ce acționează ca o balanță în boosting-ul de gradient?
Dacă fragmentul necesar se află pe locul 10 din 10, iar în context încap doar 3 — cum îl evaluezi și cum îl aduci în top 3?
Numește optimizerii. Ce este SGD?
Ce este un vector dens (embedding dens)? Cum se obține? Care este dimensiunea sa?
Ce se întâmplă dacă introduci în decodor o secvență de 10k tokeni, iar modelul a fost antrenat pe 9k?
Nivelul de engleză?
Cum se creează o împărțire train/val/test și un benchmark? Cum se împarte corect datele?
Problema de regresie: prezicerea prețului acțiunilor în al 5-lea an pe baza datelor din cei 4 ani anteriori folosind boosting. Ce greșeală am făcut?
Ce metrici au fost folosiți pentru evaluarea sistemului RAG și cum s-a luat decizia de a-l implementa în producție?
Aveți experiență cu seriile temporale?
Ce metode trebuie implementate atunci când se moștenește din clasa Dataset în PyTorch?
Ce face modelul Continuous Bag of Words (CBOW)?