Sobes.tech

Machine Learning / AI

Можеш ли да објасниш разлику између cross-encoder и bi-encoder?

221

Postoji li način da proverite da li generisani tekst ne sadrži faktualne greške u odnosu na original?

198

Kako odrediti da li model embedovanja dobro funkcioniše? Koje metrike su korišćene?

194

Kako je odabrana strategija chunkovanja (chunking) za RAG sistem?

182

Kako su podaci iz PDF dokumenata izdvojeni za RAG sistem?

180

Ispričaj mi o metriki performansi ML usluge: latencija, RPS, kako je to bilo organizovano u tvom projektu?

180

Реци ми о параметрима генерације LLM: температура, топ-к, топ-п и други.

167

Ispričaj mi o vektorskim bazama podataka, koje postoje, po čemu se razlikuju, zašto ste odabrali pgvector?

166

Ispričaj mi o kvantizaciji modela: što je to, čemu služi, koje vrste postoje?

160

Kako su Recall i Precision povezani, да ли је могуће повећати једно без смањивања другог? Наведите примере задатака.

149

Kako su organizovani podaci za sažimanje dijaloga i kako je tekao trening?

149

Koja metoda kvantizacije (int8 ili float) će manje narušiti kvalitet modela?

147

Kako bi pristupio zadatku sažimanja dijaloga više ljudi sa konferencije (npr. 10 developera na Slacku)?

144

Ispričaj mi o najtežem zadatku ili teškoći u jednom od projekata.

142

Koji model i pristup odabrati za obradu audio snimka sa konferencije (speech-to-text, diarizacija)?

137

Kako raditi sa privatnim podacima tokom lokalnog implementiranja sistema?

123

Zašto ste odabrali hibridno pretraživanje BM25 + embeddings umesto samo kosinusne udaljenosti?

119