Sobes.tech

Machine Learning / AI

Como foi organizada a inferência do LLM (DeepSeek R1 33B)? Quantas GPUs, como foi paralelizado?

197

Como funcionava a auto-correção no agente Text-to-SQL?

188

Fale sobre a arquitetura do chat RAG (iChat) na TechVille: pipeline, componentes, tecnologias.

184

Fale sobre o agente Text-to-SQL: arquitetura, pipeline, tecnologias.

179

Quais métricas foram usadas para avaliar o sistema RAG e como foi tomada a decisão de implantá-lo em produção?

177

Como avaliaram a qualidade do agente Text-to-SQL?

174

Fale sobre o projeto de sumarização de relatórios na Alrosa: tarefa, abordagem, re-treinamento.

171

Por que escolheram Qdrant em vez de ficar com Elasticsearch? Quais são as vantagens?

167

Como eram tratados os picos de carga no sistema RAG? O que acontecia sob alta carga?

163

Quais métricas de classificação foram usadas para avaliar o recuperador?

155