Sobes.tech

Machine Learning / AI

Můžeš vysvětlit rozdíl mezi cross-encoder a bi-encoder?

221

Existuje způsob, jak ověřit, že vygenerovaný text neobsahuje faktické chyby ve vztahu k originálu?

203

Jak určit, zda model embeddingů funguje dobře? Jaké metriky byly použity?

201

Jak byla data z PDF dokumentů extrahována pro RAG systém?

183

Jak byla zvolena strategie chunkování pro systém RAG?

182

Pověz mi o metrikách výkonu ML služby: latence, RPS, jak to bylo organizováno ve tvém projektu?

181

Pověz mi o parametrech generace LLM: teplota, top-k, top-p a další.

168

Povězte mi o vektorových databázích, jaké existují, čím se liší, proč jste zvolili pgvector?

167

Pověz mi o kvantizaci modelů: co to je, k čemu je to potřeba, jaké druhy existují?

165

Jak byly data organizována pro shrnutí dialogů a jak probíhalo školení?

151

Jak souvisí Recall a Precision, lze zvýšit jedno bez snižování druhého? Uveďte příklady úloh.

150

Pověz mi o nejnáročnější úloze nebo obtížnosti v jednom z projektů.

148

Která metoda kvantizace (int8 nebo float) méně poškodí kvalitu modelu?

148

Jak byste přistoupili k úkolu shrnutí dialogu více lidí z konference (například 10 vývojářů na Slacku)?

144

Jaký model a přístup zvolit pro zpracování audia z konference (speech-to-text, diarizace)?

138

Jak pracovat s soukromými daty při lokálním nasazení systému?

123

Proč jste zvolili hybridní vyhledávání BM25 + embeddings místo pouze kosinové vzdálenosti?

120