Mis on konteksti pikkus ja miks on seda raske laiendada?
Machine Learning / AI
Milliseid prompti kokkusurumise tehnikaid teate (LLMLingua)?
Mis on üleõppimine ja kuidas sellega võidelda?
Millised on üleõppimise põhjused?
Milliseid meetodeid saab mudeli parandamiseks kasutada?
Kuidas hinnata teenuse mediaanvastuse aega suure logide mahu korral, mis ei mahu mälu?
Kuidas valida andmeid mediaani hindamiseks: järjestikune läbimine või juhuslik alamhulk?
Mis on autokorrelatsioon ja osaline autokorrelatsioon (ACF, PACF)?
Millised on regulatsiooni tüübid ja kuidas nad töötavad?
Mis on kogemuste taasesitamise puffer ja milleks see on vajalik?
Miks mudeli kaalud võivad muutuda suurteks ja miks neid regulatsiooniga vähendada tuleb?
Mis on Medusa ja mitmetokeni ennustuskäed?
Mis on t-SNE/UMAP visualiseerimine CV-mudeli feature space?
Kuidas korraldada konteineriseerimine ja mudelite juurutamine?
Mis on kalibreerimine ja miks see on oluline õigluse jaoks?
Millised vead esinevad meditsiinilistes protokollides ja kuidas neid tüübitakse?
Millised meetodid on üleõppimise vastu ja kuidas need töötavad?
Mis on skip-ühendus ja milleks see on vajalik (ResNet)?
Kuidas erineb MobileNet v2 v1-st (inverted residuals)?
Rääkige masintõlke ülesandest. Mis on sequence-to-sequence?