Sobes.tech

Machine Learning / AI

Como funciona a tokenização? Porque é que se usam subword tokens em vez de palavras inteiras?

Middle+
215

Fale sobre BGE-M3: três representações — denso, esparso, multi-vetor.

Middle+
183

O que são Recall e Precision? Problema: 50 frutas, 30 maçãs e 20 peras, um robô encontrou corretamente 20 maçãs, mas confundiu 15 peras com maçãs. Calcule as métricas.

Middle+
167

Está familiarizado com LoRA e métodos de fine-tuning?

Middle+
164

Como foram selecionados os coeficientes para a pesquisa híbrida?

Middle+
163

Por que precisou de 12.000 pares de pergunta-resposta se havia apenas 15 modelos?

Middle+
151

Por que você reconheceu os documentos como imagens em vez de criar um analisador?

Middle+
147

Como você formou o conjunto de dados de teste: das mesmas 12 mil pares ou de novos dados?

Middle+
142

Fale-nos sobre a clusterização: qual problema resolveram, qual método usaram, como mediram a qualidade?

Middle+
140

Como funciona um transformador? Fale-me sobre BERT e GPT.

Middle+
138

O que é um vetor denso (embedding denso)? Como é obtido? Qual é o seu tamanho?

Middle+
137

Que modelos foram utilizados em cada etapa? Para a extração de entidades, para a vetorização, para a geração?

Middle+
135

Como avaliou a qualidade do sistema RAG? Quais métricas utilizou?

Middle+
135

O que é um cross-encoder e onde o utilizou?

Middle+
135

Por que é necessário reduzir o tamanho do dicionário? O que há de errado com um dicionário grande? Em qual função ocorre a carga?

Middle+
133

O que era enviado ao utilizador final no seu sistema?

Middle+
132

O que é um vetor esparso? Como ele difere de um vetor denso?

Middle+
130

Qual é a diferença entre pedidos GET e POST?

Middle+
129

Explique de forma simples como funciona o seu sistema para um utilizador, sem assíncronia.

Middle+
121

Para uma consulta, basta uma das 12 mil respostas ou várias?

Middle+
120