Sobes.tech

Machine Learning / AI

Kā noteikt, vai ievietošanas modelis darbojas labi? Kuras metriku tika izmantotas?

241

Vai vari paskaidrot starpību starp cross-encoder un bi-encoder?

236

Vai ir veids, kā pārbaudīt, vai ģenerētais teksts nesatur faktu kļūdas attiecībā uz oriģinālu?

217

Kā tika izņemti dati no PDF dokumentiem RAG sistēmai?

200

Pastāsti man par modeļu kvantizāciju: kas tas ir, kam tas ir nepieciešams, kādi veidi ir?

196

Kā tika izvēlēta chunking stratēģija RAG sistēmai?

193

Pastāsti par ML pakalpojuma veiktspējas metriku: latentāte, RPS, kā tas tika organizēts tavā projektā?

185

Pastāsti par vektoru datu bāzēm, kādas tās ir, kā atšķiras, kāpēc izvēlējāties pgvector?

179

Pastāsti par LLM ģenerēšanas parametriem: temperatūra, top-k, top-p un citus.

178

Kā saistīti Recall un Precision, vai ir iespējams palielināt vienu, nesamazējot otru? Sniedziet uzdevumu piemērus.

159

Pastāstiet par visgrūtāko uzdevumu vai grūtību kādā no projektiem.

157

Kā tika organizēti dati dialogu kopsavilkumam un kā notika apmācība?

157

Kura kvantizācijas metode (int8 vai float) mazāk sabojās modeļa kvalitāti?

154

Kā tu pieietu uzdevumam apkopt vairāk cilvēku dialogu konferencē (piemēram, 10 izstrādātāji Slack)?

148

Kuru modeli un pieeju izvēlēties konferences audio apstrādei (speech-to-text, diarization)?

140

Pastāsti man par LoRA: kas tas ir, kam tas ir nepieciešams?

138

Kā strādāt ar privātiem datiem sistēmas lokālai izvietošanai?

129

Kāpēc izvēlējāties hibrīda meklēšanu BM25 + embeddings vietā, lai izmantotu tikai kosinusa attālumu?

124