Come funzionava l'auto-correzione nell'agente Text-to-SQL?
Machine Learning / AI
Quali metriche sono state utilizzate per valutare il sistema RAG e come è stata presa la decisione di lanciarlo in produzione?
Parla dell'architettura della chat RAG (iChat) in TechVille: pipeline, componenti, tecnologie.
Parla dell'agente Text-to-SQL: architettura, pipeline, tecnologie.
Come è stata organizzata l'inferenza di LLM (DeepSeek R1 33B)? Quante GPU, come sono state parallelizzate?
Parla del progetto di riassunto dei rapporti in Alrosa: compito, approccio, riaddestramento.
Perché avete scelto Qdrant invece di rimanere su Elasticsearch? Quali sono i vantaggi?
Come venivano gestiti i picchi di carico nel sistema RAG? Cosa succedeva sotto carico elevato?
Come avete valutato la qualità dell'agente Text-to-SQL?
Quali metriche di ranking sono state utilizzate per valutare il recuperatore?