Ce este lungimea contextului și de ce este dificil să o extinzi?
Machine Learning / AI
Ce tehnici de comprimare a prompturilor cunoașteți (LLMLingua)?
Ce este supraînvățarea și cum o combatem?
Care sunt cauzele supraînvățării?
Ce metode pot fi utilizate pentru a îmbunătăți modelul?
Cum se evaluează timpul mediu de răspuns al serviciului în cazul unui volum mare de jurnale care nu încap în memorie?
Ce este autocorelația și autocorelația parțială (ACF, PACF)?
Cum alegi datele pentru estimarea medianei: parcurgerea secvențială sau eșantionarea aleatorie?
Ce tipuri de regularizare există și cum funcționează?
Ce este un buffer de redare a experienței și la ce folosește?
De ce pot deveni mari greutățile modelului și de ce trebuie să le reducem prin regularizare?
Ce este vizualizarea spațiului de caracteristici al unui model CV cu t-SNE/UMAP?
Ce este Medusa și capetele de predicție multi-token?
Cum să organizezi containerizarea și implementarea modelelor?
Ce este calibrarea și de ce este importantă pentru echitate?
Ce tipuri de erori există în protocoalele medicale și cum sunt tipizate?
Proiectați un sistem OCR + NLP pentru procesarea scanărilor de contracte.
Vorbiți despre sarcina de traducere automată. Ce este sequence-to-sequence?
Ce metode de combatere a supraînvățării există și cum funcționează?
Ce este o conexiune skip și la ce folosește (ResNet)?