Sobes.tech

Machine Learning / AI

Poți explica diferența dintre cross-encoder și bi-encoder?

220

Există o metodă de a verifica dacă textul generat nu conține erori factuale în raport cu originalul?

197

Cum se determină dacă modelul de embedding funcționează bine? Ce metrici au fost utilizate?

193

Cum a fost aleasă strategia de chunking pentru sistemul RAG?

182

Vorbește-mi despre metricile de performanță ale serviciului ML: latență, RPS, cum a fost organizat în proiectul tău?

180

Cum au fost extrase datele din documentele PDF pentru sistemul RAG?

179

Vorbește-mi despre bazele de date vectoriale, care există, în ce diferă, de ce ați ales pgvector?

166

Vorbește despre parametrii de generare LLM: temperatură, top-k, top-p și altele.

166

Vorbește-mi despre cuantizarea modelelor: ce este, la ce folosește, ce tipuri există?

159

Cum se corelează Recall și Precision, se poate crește unul fără a reduce celălalt? Oferiți exemple de sarcini.

149

Cum au fost organizate datele pentru sumarizarea dialogurilor și cum a avut loc antrenamentul?

149

Ce metodă de cuantizare (int8 sau float) va afecta mai puțin calitatea modelului?

147

Cum ai aborda sarcina de a rezuma un dialog între mai multe persoane dintr-o conferință (de exemplu, 10 dezvoltatori pe Slack)?

144

Vorbește despre cea mai dificilă sarcină sau dificultate din unul dintre proiecte.

142

Ce model și abordare să aleg pentru procesarea audio dintr-o conferință (speech-to-text, diarizare)?

137

Cum să lucrați cu date private în timpul implementării locale a sistemului?

123

De ce ați ales căutarea hibridă BM25 + embeddings în loc de doar distanța cosinus?

119