Machine Learning / AI
Je možné použiť centrálnu limitnú teóriu pri nenormálnom rozdelení základnej populácie?
Čo je špekulatívne dekódovanie a ako zrýchľuje generovanie?
Ako implementovať voice-agent s nízkou latenciou (streaming STT + LLM + TTS)?
Čo je BERTScore a prečo je lepší ako BLEU pri hodnotení generácie?
Čo je to trade-off medzi zaujatím a rozptylom?
Aké praktiky sa používajú pri synchronizácii tréningových a servisných funkcií?
Čo je to word2vec?
Aké sú spôsoby optimalizácie ťažkých dopytov do databázy?
Čo je CUTLASS?
Čo je dĺžka kontextu a prečo je ťažké ju rozšíriť?
Ako bol BERT vyškolen? Čo sú MLM a NSP?
Čo je krížová validácia a na čo je potrebná?
ROC-AUC = 0.9. Čo sa stane s touto metrikou, ak vynásobíme všetky predpovede modelu číslom 3?
Aké metódy výberu vlastností existujú?
Korelačný koeficient je rovný 0. Môžeme tvrdiť, že vzorky sú nezávislé? Prečo?
Aké problémy môžu nastať pri jednorozmernom pozičnom kódovaní pri práci s obrázkami?
Čo je target encoding a aké má problémy (overfitting, leakage)?
Dochádza k driftu modelu pri tréningu s dropoutom a inferencii bez neho?
Čo sú časové grafy znalostí?
Aké metódy validácie modelov časových radov vylučujú pohľad do budúcnosti počas tréningu?