Ce este operatorul HAVING în SQL? Unde este utilizat?
Machine Learning / AI
Problema de regresie: prezicerea prețului acțiunilor în al 5-lea an pe baza datelor din cei 4 ani anteriori folosind boosting. Ce greșeală am făcut?
Ce sunt metricile MAPE și SMAPE? Unde pot fi ineficiente?
Povestiți-ne despre proiectul de evaluare a calității muncii dispecerilor: ce modele au fost utilizate, cum au fost comparate cu scriptul de referință?
De ce CatBoost, și nu XGBoost sau LightGBM? Care sunt diferențele?
Vorbiți despre proiectul de clusterizare a solicitărilor cu etichetare în funcție de importanța pentru afaceri.
Sarcina MVP: clasificare binară cu dezechilibru al claselor, datele sunt distribuite pe 10 mașini, există o caracteristică textuală. Ce abordare ați propune?
Care sunt cele mai prioritare metrici în cazul unui dezechilibru mare al claselor (99 la 1)?
Știți protocoalele HTTP, UDP, TLS?
Care este diferența principală dintre Spark și Pandas? Ce este Hadoop?
Știi ce este bagging? Oferă un exemplu de algoritm.
Vorbește despre algoritmul K-means și variantele sale avansate (K-means++).
Ce este LoRA (Low-Rank Adaptation)?
Spuneți-ne despre voi, experiența și proiectele dvs.
Spune-mi mai multe despre proiectul de previzionare a plecării angajaților: ce ați făcut, ce date ați folosit, de ce ați ales CatBoost?
Ce metrici sunt utilizate pentru a evalua calitatea clusterizării? Cum se alege numărul de clustere?