Machine Learning / AI
Co je Wide&Deep a proč míchat memorization a generalization?
Jaké jsou problémy při detekci long-tail tříd?
Co je to sémantická segmentace satelitních snímků a jaké modely se používají?
Jaké nástrahy se objevují při RAG v chatovém scénáři (kontext dialogu, historie)?
Jaké úkoly vás zajímají a čím chcete zaměstnat?
Proč maximalizovali Recall, když zároveň říkají, že se nesnažili pokrýt všechno?
Jak hodnotíte svou úroveň práce s SQL?
Co je to video transformer (ViViT, TimeSformer)?
V jakých úlohách pomáhá CoT a v jakých kazí kvalitu?
Čím se liší základní model od instruct/chat modelu?
Proč se při aktualizaci vah používá porovnání s epsilonem?
Můžete vysvětlit mechanismus fungování algoritmu k nejbližších sousedů?
Co je to řetězec ověření (CoVe)?
Jak strom a lineární regrese předpovídají pro objekt s vlastností mimo tréninkový rozsah?
Co je to OCR-free porozumění dokumentům (Donut, Pix2Struct)?
Jak vypadá tvůj vývojový proces — dostaneš modely až do Dockeru, zabalíš je a předáš někomu jinému?
Zapište vzorec Log Loss (binární křížová entropie).
Popište úkol integrace virtuální ústředny s CRM pro zobrazení karty zákazníka při příchozím hovoru.
Co dělat s daty s různou časovou granularitou: některá jsou zaznamenávána každou hodinu, jiná denně?
Proč bylo použito CatBoost?