Machine Learning / AI
Jaký je úplný pipeline tréninku modelu?
Co děláš na fakultě?
Jaké jsou metriky offline hodnocení doporučení (Recall@K, MAP, NDCG, MRR)?
Jaká řešení navrhnout při nárůstu zátěže na systém?
V čem se obecně liší ChatGPT od asistenta uvnitř firmy (chat-robot vs asistent)?
Jak porovnat souřadnice s plovoucí desetinnou čárkou s ohledem na vlastnosti float v různých jazycích?
Co je RAG? Můžeš to vysvětlit?
Jaké jsou vaše znalosti o teorii pravděpodobnosti?
Co je to maska padding klíče vs maska pozornosti v PyTorch?
Jak dělíme data pro křížovou validaci?
Dan je řetězec obsahující písmena a číslice. Najděte největší číslo, které se v řetězci vyskytuje (považujte po sobě jdoucí číslice za jedno číslo).
Popište architekturu U-Net a k čemu slouží skip connectiony.
Co je to stochastická hloubka a proč se používá v EfficientNet?
Co je přístup jazykového modelu k IR (Ponte-Croft)?
Jaké obchodní problémy řeší analýza přežití (churn, obratovost)?
Jak byste optimalizovali indexy na spojovacích klíčích, aby se snížily duplicity a urychlila dotaz?
Byla-li dokumentárně potvrzena souhrnná zkušenost 3 roky a 2 měsíce?
Co je rychlejší, hledání ve slovníku nebo v seznamu, a proč?
Praktický úkol SQL dotaz na 80 milionů zpráv vytváří duplicitní záznamy po JOINu. Jakou akci je nejlepší začít jako první? - Zkontrolovat kardinalitu JOINu, klíče a plán provedení před optimalizací. - Vytvořit index na jednom poli spojení. - Exportovat výsledek do CSV a odstranit duplicitní záznamy v Pythonu. - Vždy přidat DISTINCT ke všem sloupcům. - Přidat DISTINCT po kontrole výsledku na vzorku. - Zkontrolovat klíče spojení a jedinečnost obou tabulek.
Co je AWQ a jaký je nápad per-channel scaling?