Kas ir HAVING operators SQL? Kur tas tiek izmantots?
Machine Learning / AI
Regresijas uzdevums: prognozēt akciju cenu 5. gadā, izmantojot 4 gadu datus ar boosting. Kādu kļūdu mēs pieļāvām?
Kas ir MAPE un SMAPE metriki? Kur tie varētu būt neefektīvi?
Pastāstiet mums par dispečeru darba kvalitātes novērtēšanas projektu: kādus modeļus izmantoja, kā salīdzināja ar standarta scenāriju?
Kāpēc CatBoost, nevis XGBoost vai LightGBM? Kādas ir atšķirības?
MVP uzdevums: bināra klasifikācija ar nelīdzsvarotām klasēm, dati ir sadalīti 10 mašīnās, ir teksta īpašība. Kādu pieeju ieteiktu?
Pastāstiet par klasterizācijas projektu ar marķējumu pēc biznesa nozīmīguma.
Kuras metrikas ir visvairāk prioritātes pie lielas klases nelīdzsvarotības (99 pret 1)?
Vai jūs zināt HTTP, UDP, TLS protokolus?
Kāda ir galvenā atšķirība starp Spark un Pandas? Kas ir Hadoop?
Vai zināt, kas ir bagging? Sniedziet algoritma piemēru.
Kas ir LoRA (Low-Rank Adaptation)?
Pastāstiet vairāk par darbinieku aiziešanas prognozēšanas projektu: ko darījāt, kādus datus izmantojāt, kāpēc izvēlējāties CatBoost?
Pastāstiet par K-means algoritmu un tā uzlabotajām analogijām (K-means++).
Pastāstiet par sevi, savu pieredzi un projektiem.
Kādas metriku tiek izmantotas klasterizācijas kvalitātes novērtēšanai? Kā izvēlēties klasteru skaitu?