Machine Learning / AI
Papaskinkite apie mašininio vertimo užduotį. Kas yra sequence-to-sequence?
Ką reiškia TF ir IDF komponentai?
Aprašykite užduotį suartėjusių skaičių sujungimui į intervalus.
Kaip apskaičiuoti A/B testo mėginio dydį?
Kokius modelių tipus žinote detekcijos užduotims (R-CNN šeima, YOLO, SSD, DETR)?
Kas yra generatyviniai molekulių modeliai?
Kaip sukurti matavimo priemonę, kuri atsižvelgtų į pelno tikėtinumą ir pardavimo tikimybę pagal kategorijas?
Kokias sprendimų priimti esant išteklių trūkumui apdorojant vėluojančius užklausimus?
Kokios reguliavimo metodai yra ne linijiniams modeliams?
Kas yra lazy skaičiavimai Spark?
Kas yra Thompson sampling ir UCB?
Kaip priimti sprendimą dėl nuostolių funkcijos modeliui iš verslo ir duomenų perspektyvos?
Kas yra OSM ir kaip iš jo išgauti labels?
Kaip padidinti testo greitį be modelio pakartotinio mokymo?
Kas yra kvantizacija mašininio mokymosi srityje? Kaip vyksta FP32 į INT8 kvantizacija — nuo slankiojo kablelio skaičiaus iki sveiko skaičiaus?
Kas yra NSP (kitos sakinio prognozė) ir kodėl RoBERTa jos atsisakė?
Kuo skiriasi NDCG ir Accuracy matricos? Kuris svarbesnis naujienų srautui?
Kaip atlikti faktorių binarizaciją, pavyzdžiui, amžių?
Kokias metodikas galima naudoti vaizdų generavimui (GAN, VAE, difuzija, autoregresyvūs)? Kiekvieno privalumai ir trūkumai.
Kuo skiriasi top-k imtis ir top-p (branduolio) imtis?