Machine Learning / AI
Ce este completarea KG?
Ce este un grafic de cunoaștere și unde sunt utilizate?
Cum se împart datele în straturi pentru validare?
Ce tipuri de date sunt potrivite ca cheie de dicționar în Python și de ce?
Ce este LayoutLM și versiunile sale (v1, v2, v3)?
Ce este PPO și de ce este mai convenabil decât TRPO în practică?
Cum să lucrați cu valorile lipsă din setul de date?
Ce este HELM și ce sarcini acoperă?
Ce se întâmplă dacă ștergem primul sau ultimul copac în boosting?
Ce metrici de clasificare multiclasă cunoști? Avantajele și dezavantajele lor (macro, micro, ponderată).
Cum se formează datele de antrenament pentru clasificare pe baza istoricului vizualizărilor și achizițiilor?
Ce este supraînvățarea? Care sunt modalitățile de a o combate?
Ce este curba ROC?
Ce este un model de limbaj video (VideoLLaMA, Video-ChatGPT)?
Care sunt modelele moderne TTS (Tortoise, XTTS, StyleTTS2, ElevenLabs)?
Ce se întâmplă cu calitatea fiecărui model dacă eliminăm primul copac construit într-un gradient boosting și o pădure aleatorie de 1000 de copaci?
De ce se folosește rar funcția sigmoidă ca funcție de activare în rețelele neuronale?
Ce este Faiss și cum funcționează?
Care este ideea matematică din spatele modelelor de difuzie? Ce sunt procesul forward și reverse?
Ce este multicoliniaritatea caracteristicilor? De ce este periculoasă și cum o detectăm?