Como foi organizada a inferência do LLM (DeepSeek R1 33B)? Quantas GPUs, como foi paralelizado?
Machine Learning / AI
3608
0
Middle+
197
Como funcionava a auto-correção no agente Text-to-SQL?
Middle+
188
Fale sobre a arquitetura do chat RAG (iChat) na TechVille: pipeline, componentes, tecnologias.
Middle+
184
Fale sobre o agente Text-to-SQL: arquitetura, pipeline, tecnologias.
Middle+
179
Quais métricas foram usadas para avaliar o sistema RAG e como foi tomada a decisão de implantá-lo em produção?
Middle+
177
Como avaliaram a qualidade do agente Text-to-SQL?
Middle+
174
Fale sobre o projeto de sumarização de relatórios na Alrosa: tarefa, abordagem, re-treinamento.
Middle+
171
Por que escolheram Qdrant em vez de ficar com Elasticsearch? Quais são as vantagens?
Middle+
167
Como eram tratados os picos de carga no sistema RAG? O que acontecia sob alta carga?
Middle+
163
Quais métricas de classificação foram usadas para avaliar o recuperador?
Middle+
155