Sobes.tech

Machine Learning / AI

Como avaliar a qualidade do recuperador? De onde obter uma coleção de documentos para avaliar as métricas?

370

Tem um pequeno conjunto de dados com críticas de filmes em russo e a sua etiqueta binária de tonalidade (rótulos: 0 — negativo, 1 — positivo). A sua tarefa é implementar um pipeline completo em 15 minutos para treinar um modelo simples de classificação de texto sem usar codificadores pré-treinados como BERT, e mostrar a precisão (accuracy) nestes dados. reviews = [ "Este filme é simplesmente incrível!", "Atuação horrível e enredo entediante.", "Gostei de cada momento!", "O pior filme que já vi.", "Ótimo trabalho de direção e história maravilhosa.", "Insoportavelmente entediante e previsível." ] labels = [1, 0, 1, 0, 1, 0]

183

Qual parâmetro no modelo de embedding determina o número máximo de tokens na entrada? O que acontece se forem fornecidos mais tokens do que o limite?

168

Como a aumento do tamanho do batch em 4 vezes afeta a taxa de aprendizagem e por quê? Como funciona a retropropagação?

165

O que é a quantização do modelo e o que acontece com os pesos ao aplicá-la no vLLM?

155

O que acontece se fornecer um contexto de 120 000 tokens num LLM com um limite de 60 000?

151

Como foi organizada a busca de informações na base vetorial? Por que usaram Qdrant?

141

O que é o LangGraph, para que é utilizado, como são implementados os ramos e as transições condicionais? Em que os instrumentos diferem dos nós?

140