Machine Learning / AI
Kas on küsimusi ülesande tingimuse kohta?
Miks LayerNorm rakendub viimasele mõõtmele, mitte partii peale?
Kirjutage lühike eneseesitluse lõik, kus rõhutate, et soovitussüsteemid on väga sarnased RAG-iga - retrieval, re-ranking, arhitektuurilised sarnasused ja nii edasi, et ma saaksin seda meelde jätta ja rääkida.
Mis on stochastic depth ja miks see on EfficientNetis kasutusel?
Mis on Dirichlet siledus IR-keele mudelis?
Mis on vestlusmall ja milleks see on kasutusel juhendavate mudelite puhul?
Mis on minimaal tuvastatav mõju (MDE)?
Kuidas määrata, kas kaks lauset on sarnased tähenduse poolest?
Mis on alguse tuvastamine?
Millised on BERT-i probleemid teksti genereerimise ülesannetes?
Millised on juhendatud ja juhendamata õppimise ülesannete erinevused?
Kas dokumentaalselt kinnitatud kogemuste koguarv on 3 aastat ja 2 kuud?
Rääkige Mask R-CNN-ist. Milline pea lisatakse Faster R-CNN-i peale?
Antud on rekursiivne jada x_n = A * x_{n-1}, kus A on maatriks, x on vektor ja x_0 on juhuslik. Millele läheneb jada, kui n → ∞?
Kuidas töötab regulatsioon otsustuspuidudes?
Milline on n-nda puu sihtmuutuja gradient boostimises?
Kellel on suurem vastuvõtuala: kaks järjestikust 3x3 konvolutsiooni või üks 5x5 konvolutsioon?
Kuidas luua ajaridade põhine mudel metrikate ja heuristikatega?
Millised on logistilise regressiooni ja gradient boostingu eelised ning millistes ülesannetes neid kasutada?
Kuidas töötab tähelepanu mehhanism BERT-is ja miks see on tõhusam kui Word2Vec?