Como avaliar a qualidade do recuperador? De onde obter uma coleção de documentos para avaliar as métricas?
Machine Learning / AI
O que é vLLM e para que é utilizado?
Qual é a diferença entre Tensor Parallel Size e Data Parallel Size no vLLM?
Tem um pequeno conjunto de dados com críticas de filmes em russo e a sua etiqueta binária de tonalidade (rótulos: 0 — negativo, 1 — positivo). A sua tarefa é implementar um pipeline completo em 15 minutos para treinar um modelo simples de classificação de texto sem usar codificadores pré-treinados como BERT, e mostrar a precisão (accuracy) nestes dados. reviews = [ "Este filme é simplesmente incrível!", "Atuação horrível e enredo entediante.", "Gostei de cada momento!", "O pior filme que já vi.", "Ótimo trabalho de direção e história maravilhosa.", "Insoportavelmente entediante e previsível." ] labels = [1, 0, 1, 0, 1, 0]
O que é RAG e qual problema fundamental ele resolve?
Qual parâmetro no modelo de embedding determina o número máximo de tokens na entrada? O que acontece se forem fornecidos mais tokens do que o limite?
Como a aumento do tamanho do batch em 4 vezes afeta a taxa de aprendizagem e por quê? Como funciona a retropropagação?
Fala-me sobre ti e a tua experiência
O que é um modelo de incorporação e o que é um token?
O que é a quantização do modelo e o que acontece com os pesos ao aplicá-la no vLLM?
Como são extraídos os dados da base vetorial por uma consulta do utilizador?
O que acontece se fornecer um contexto de 120 000 tokens num LLM com um limite de 60 000?
Como foi organizada a busca de informações na base vetorial? Por que usaram Qdrant?
O que é o LangGraph, para que é utilizado, como são implementados os ramos e as transições condicionais? Em que os instrumentos diferem dos nós?