Mis on HAVING operaator SQL-is? Kus seda kasutatakse?
Machine Learning / AI
Regressioonülesanne: prognoosida aktsiahind 5. aastal kasutades 4 aasta andmeid boostinguga. Millist viga me tegime?
Mis on MAPE ja SMAPE mõõdikud? Kus nad võivad olla ebaefektiivsed?
Rääkige meile dispetšerite töö kvaliteedi hindamise projektist: milliseid mudeleid kasutati, kuidas neid võrreldi etalonstsenaarjiga?
Miks valida CatBoost, mitte XGBoost või LightGBM? Millised on erinevused?
MVP ülesanne: binaarne klassifikatsioon klasside ebavõrdsusega, andmed on jaotatud 10 masinasse, on tekstiline omadus. Millist lähenemist soovitaksite?
Rääkige meile klasteriseerimisprojektist, kus märgistatakse ärilise tähtsuse järgi.
Millised mõõdikud on kõige olulisemad suure klasside ebavõrdsuse korral (99 kuni 1)?
Kas teate HTTP, UDP, TLS protokolle?
Mis on Spark ja Pandas peamine erinevus? Mis on Hadoop?
Kas teate, mis on bagging? Andke näide algoritmist.
Mis on LoRA (Low-Rank Adaptation)?
Rääkige mulle rohkem töötajate väljalangemise prognoosimise projektist: mida te tegite, milliseid andmeid kasutasite, miks valisite CatBoost?
Rääkige endast, oma kogemusest ja projektidest.
Rääkige K-means algoritmist ja selle arenenud analoogidest (K-means++).
Milliseid mõõdikuid kasutatakse klasterimise kvaliteedi hindamiseks? Kuidas valida klasterite arv?