Jak předzpracovat text: jaká stop slova a interpunkci odstranit, použít stemming nebo lemmatizaci?
Machine Learning / AI
Co je to pseudo-relevance feedback?
Co je to analýza rozvržení v dokumentech?
Co je to dlouhodobá paměť agenta a jak ji budovat (shrnutí, vektorová paměť)?
Jak pracovat s neúplnými daty z různých serverů a tabulek?
Jak probíhá onboarding a školení nových zaměstnanců v projektu?
Co je to cross-modal retrieval?
Co je GPTQ a jaký přístup se používá při výběru vah?
Co je to global average pooling a proč nahrazuje plně propojenou vrstvu?
Jaké jsou specifické optimalizace pro ARM (NEON)?
Jak implementovat sloučení dvou seřazených polí do jednoho seřazeného pole?
Jak využít klasické strojové učení ke zlepšení rozpoznávání produktů?
Co je to graf a jak se pro neuronové sítě představuje (matice sousednosti, seznam hran)?
Existují data pro ověření řešení nebo je třeba vytvořit testovací data sami?
Proč lze pro klasifikaci použít rozhodovací strom?
Co je to Markovův rozhodovací proces (MDP) a jaké má složky?
Co je sdílená paměť a proč ji používat?
Jak spojit účtenky s produkty při neúplných údajích?
Existují analytici, kteří se zabývají stahováním dat a přípravou vitrín?
Co je Medusa a hlavy pro předpověď více tokenů?