Sobes.tech

Machine Learning / AI

Hoe bepaal je of het embeddingmodel goed presteert? Welke metrics werden gebruikt?

239

Kun je het verschil tussen cross-encoder en bi-encoder uitleggen?

236

Is er een manier om te controleren of de gegenereerde tekst geen feitelijke fouten bevat ten opzichte van het origineel?

217

Hoe werden gegevens uit PDF-documenten gehaald voor het RAG-systeem?

200

Vertel me over de kwantisatie van modellen: wat is het, waar is het voor, welke soorten zijn er?

194

Hoe werd de chunking-strategie gekozen voor het RAG-systeem?

193

Hoe test je een geïmplementeerde service op FastAPI?

186

Vertel me over de prestatietrends van de ML-dienst: latency, RPS, hoe was dit georganiseerd in jouw project?

185

Vertel me over vector databases, welke zijn er, hoe verschillen ze, waarom hebben jullie voor pgvector gekozen?

179

Vertel me over de parameters van LLM-generatie: temperatuur, top-k, top-p en andere.

178

Vertel over de moeilijkste taak of uitdaging in een van de projecten.

157

Hoe zijn de gegevens georganiseerd voor de samenvatting van dialogen en hoe verliep de training?

157

Hoe verhouden Recall en Precision zich tot elkaar, is het mogelijk om het ene te verhogen zonder het andere te verlagen? Geef voorbeelden van taken.

157

Welke kwantiseringsmethode (int8 of float) schaadt de modelkwaliteit minder?

154

Hoe zou je de taak aanpakken om een dialoog van meerdere mensen uit een conferentie samen te vatten (bijvoorbeeld 10 ontwikkelaars op Slack)?

148

Welke model en aanpak kiezen voor het verwerken van audio uit een conferentie (spraak-naar-tekst, diarization)?

140

Hoe om te gaan met privégegevens bij lokale implementatie van het systeem?

129

Waarom hebben ze gekozen voor hybride zoekopdracht BM25 + embeddings in plaats van alleen de cosinusafstand?

124