Hoe werkte zelfcorrectie in de Text-to-SQL-agent?
Machine Learning / AI
Vertel over de architectuur van de RAG-chat (iChat) in TechVille: pipeline, componenten, technologieën.
Vertel ons over de Text-to-SQL-agent: architectuur, pipeline, technologieën.
Welke metrics werden gebruikt om het RAG-systeem te evalueren en hoe werd de beslissing genomen om het in productie te brengen?
Hoe was de inferentie van LLM (DeepSeek R1 33B) georganiseerd? Hoeveel GPU's, hoe werd parallel gewerkt?
Vertel over het samenvattingsproject van rapporten bij Alrosa: taak, aanpak, bijscholing.
Waarom hebben jullie voor Qdrant gekozen in plaats van bij Elasticsearch te blijven? Wat zijn de voordelen?
Hoe hebben jullie de kwaliteit van de Text-to-SQL-agent beoordeeld?
Hoe werden de pieken in de belasting in het RAG-systeem afgehandeld? Wat gebeurde er bij hoge belasting?
Welke rangschikkingsmetriek werden gebruikt om de retrieve te evalueren?