Machine Learning / AI
Vorbiți despre sarcina de traducere automată. Ce este sequence-to-sequence?
Este întotdeauna rău un spill pe disc?
Ai experiență cu MongoDB sau baze de date orientate pe documente similare?
Care sunt proiectele și sarcinile pe care le are echipa?
Ce metode de regularizare există pentru modelele neliniare?
Cum se antrenează modelul? Descrieți algoritmul de actualizare a greutăților.
Ce este căutarea cu fascicul și de ce este folosită rar pentru generarea deschisă?
Cum se rezolvă problema sumării veniturilor pe un volum mare de date?
Ce sunt autoencoderele mascate (MAE) pentru CV?
Ce distribuții există și unde sunt aplicate?
Ce este MC Dropout ca aproximație Bayesiană?
Ce este Kosmos și multi-modal LLM?
Ce este pierderea Dice și de ce este adesea mai bună decât BCE pentru segmentarea medicală?
Cum se evaluează timpul mediu de răspuns al serviciului în cazul unui volum mare de jurnale care nu încap în memorie?
Ce este NSP (previziunea următoarei propoziții) și de ce a renunțat RoBERTa la ea?
Care sunt cazurile de utilizare ale uplift în marketing (populația țintă)?
Ce metode pot fi utilizate pentru generarea de imagini (GAN, VAE, difuzie, autoregresive)? Avantajele și dezavantajele fiecăruia.
Care este diferența dintre eșantionarea top-k și eșantionarea top-p (nucleu)?
Ce este eșantionarea stratificată în experimente?
Din ce dată ești gata să începi colaborarea în cazul unei decizii pozitive?