Můžeš vysvětlit rozdíl mezi cross-encoder a bi-encoder?
Machine Learning / AI
Existuje způsob, jak ověřit, že vygenerovaný text neobsahuje faktické chyby ve vztahu k originálu?
Jak určit, zda model embeddingů funguje dobře? Jaké metriky byly použity?
Jak byla data z PDF dokumentů extrahována pro RAG systém?
Jak byla zvolena strategie chunkování pro systém RAG?
Jak otestovat implementovanou službu na FastAPI?
Pověz mi o metrikách výkonu ML služby: latence, RPS, jak to bylo organizováno ve tvém projektu?
Pověz mi o parametrech generace LLM: teplota, top-k, top-p a další.
Povězte mi o vektorových databázích, jaké existují, čím se liší, proč jste zvolili pgvector?
Pověz mi o kvantizaci modelů: co to je, k čemu je to potřeba, jaké druhy existují?
Jak byly data organizována pro shrnutí dialogů a jak probíhalo školení?
Jak souvisí Recall a Precision, lze zvýšit jedno bez snižování druhého? Uveďte příklady úloh.
Pověz mi o nejnáročnější úloze nebo obtížnosti v jednom z projektů.
Která metoda kvantizace (int8 nebo float) méně poškodí kvalitu modelu?
Jak hodnotit kvalitu shrnutí?
Jak byste přistoupili k úkolu shrnutí dialogu více lidí z konference (například 10 vývojářů na Slacku)?
Jaký model a přístup zvolit pro zpracování audia z konference (speech-to-text, diarizace)?
Pověz mi o LoRA: co to je, k čemu to je?
Jak pracovat s soukromými daty při lokálním nasazení systému?
Proč jste zvolili hybridní vyhledávání BM25 + embeddings místo pouze kosinové vzdálenosti?