Sobes.tech

Python

Pode ocorrer uma condição de corrida no código assíncrono Python?

202

Quantos documentos foram recuperados na pesquisa? Houve re-ranking?

186

Como funcionava o cache semântico no Redis?

164

Como foi avaliada a qualidade do trabalho do sistema RAG?

163

Como monitorizaste o funcionamento do serviço? O que viste no Grafana?

155

O que mais pode ser otimizado no método predict? (criação de DataFrame a cada vez)

142

Por que é melhor usar POST em vez de GET para este endpoint?

139

Escrever um serviço web no FastAPI que aceite uma requisição POST com dados (renda, idade, valor do empréstimo) e retorne a previsão do modelo ML (aprovação do empréstimo)

138

Como otimizar o serviço para que uma tarefa síncrona de CPU (modelo de previsão) não bloqueie o event loop do FastAPI?

137

Fale-me de todo o pipeline do sistema RAG: quais documentos foram usados, como foram carregados e processados?

133

O que é Singleton e como aplicá-lo para carregar um modelo? Quais são as desvantagens do Singleton?

133

Quanto tempo levou toda a pipeline RAG desde o pedido até à resposta?

125

Como os documentos foram carregados na base de dados vetorial? Como ocorreu o chunking?

116

Qual é o problema que surge e como resolvê-lo se um serviço assíncrono usa um modelo ML local (por exemplo, um reranker) que é chamado de forma síncrona?

113

Como foram obtidos os embeddings? Através de qual modelo e como foi executado?

108

Como funciona a multitarefa em Python tendo em conta o GIL? Em que os threads diferem dos processos?

106