Sobes.tech

Machine Learning / AI

Ako určiť, či model embeddingov funguje dobre? Aké metriky boli použité?

247

Môžeš vysvetliť rozdiel medzi cross-encoder a bi-encoder?

236

Existuje spôsob, ako overiť, že generovaný text neobsahuje faktické chyby v porovnaní s originálom?

219

Povedaj mi o kvantizaciji modelov: čo je to, na čo je to, aké druhy existujú?

204

Ako boli údaje z PDF dokumentov extrahované pre systém RAG?

200

Ako bola zvolená stratégia chunkovania pre systém RAG?

193

Povedaj mi o metrikah zmogljivosti ML storitve: latenca, RPS, kako je bilo to organizirano v tvojem projektu?

185

Porozprávaj mi o vektorových databázach, aké existujú, v čom sa líšia, prečo ste si vybrali pgvector?

179

Povedz mi o parametroch generácie LLM: teplota, top-k, top-p a ďalšie.

178

Ako súvisia Recall a Precision, je možné zvýšiť jedno bez znižovania druhého? Uveďte príklady úloh.

161

Porozprávaj mi o najťažšej úlohe alebo ťažkosti v jednom z projektov.

159

Ako boli údaje organizované pre zhrnutie dialógov a ako prebiehalo školenie?

157

Ktorá metóda kvantizácie (int8 alebo float) poškodí kvalitu modelu menej?

154

Ako by ste pristúpili k úlohe zhrnutia dialógu viacerých ľudí z konferencie (napríklad 10 vývojárov na Slacku)?

148

Aký model a prístup zvoliť pre spracovanie audia z konferencie (speech-to-text, diarizácia)?

140

Ako pracovať s súkromnými údajmi pri lokálnom nasadení systému?

129

Prečo ste zvolili hybridné vyhľadávanie BM25 + embeddings namiesto len kosínusovej vzdialenosti?

124