Comment évaluer la qualité du récupérateur ? D'où obtenir une collection de documents pour évaluer les métriques ?
Machine Learning / AI
Qu'est-ce que vLLM et à quoi sert-il?
Vous avez un petit ensemble de données avec des critiques de films en russe et leur étiquette binaire de tonalité (étiquettes : 0 — négatif, 1 — positif). Votre tâche est de mettre en œuvre un pipeline complet en 15 minutes pour entraîner un modèle simple de classification de texte sans utiliser d'encodeurs pré-entraînés comme BERT, et d'afficher la précision (accuracy) sur ces données. reviews = [ "Ce film est tout simplement incroyable!", "Jeu d'acteurs horrible et intrigue ennuyeuse.", "J'ai adoré chaque instant!", "Le pire film que j'ai vu.", "Excellent travail de réalisation et histoire merveilleuse.", "Insoportable ennuyeux et prévisible." ] labels = [1, 0, 1, 0, 1, 0]
Quelle est la différence entre Tensor Parallel Size et Data Parallel Size dans vLLM?
Qu'est-ce que RAG et quel problème fondamental résout-il?
Quel paramètre dans le modèle d'embedding détermine le nombre maximum de tokens à l'entrée ? Que se passe-t-il si l'on fournit plus de tokens que la limite ?
Comment l'augmentation de la taille du batch par 4 influence-t-elle le taux d'apprentissage et pourquoi ? Comment fonctionne la rétropropagation ?
Parle-moi de toi et de ton expérience
Qu'est-ce qu'un modèle d'embedding et qu'est-ce qu'un token?
Comment les données sont-elles extraites de la base vectorielle par une requête utilisateur?
Qu'est-ce que la quantification du modèle et que se passe-t-il avec les poids lors de son application dans vLLM?
Que se passe-t-il si on fournit un contexte de 120 000 tokens dans un LLM avec une limite de 60 000 ?
Comment la recherche d'informations a-t-elle été organisée dans la base vectorielle ? Pourquoi avoir utilisé Qdrant ?
Qu'est-ce que LangGraph, à quoi sert-il, comment sont implémentées les branches et les sauts conditionnels ? En quoi les outils diffèrent-ils des nœuds ?