Cum funcționa auto-corectarea în agentul Text-to-SQL?
Machine Learning / AI
Povestiți-ne despre agentul Text-to-SQL: arhitectură, pipeline, tehnologii.
Ce metrici au fost folosiți pentru evaluarea sistemului RAG și cum s-a luat decizia de a-l implementa în producție?
Vorbiți despre arhitectura chat-ului RAG (iChat) în TechVille: pipeline, componente, tehnologii.
Cum a fost organizată inferența LLM (DeepSeek R1 33B)? Câte GPU-uri, cum au fost paralelizate?
Vorbește despre proiectul de sumarizare a rapoartelor la Alrosa: sarcină, abordare, reantrenament.
De ce ați ales Qdrant în loc să rămâneți pe Elasticsearch? Care sunt avantajele?
Cum ați evaluat calitatea agentului Text-to-SQL?
Cum au fost gestionate vârfurile de încărcare în sistemul RAG? Ce se întâmpla în condiții de încărcare mare?
Ce metrici de clasificare au fost utilizate pentru evaluarea recuperatorului?