Comment choisir la taille du vecteur d'incorporation?
Machine Learning / AI
Quelle est la différence entre le pooling mean/max et le pooling apprenable?
Quelles sont les limitations de Whisper et comment les contourner (long-form, hallucinations) ?
Qu'est-ce que la NSP (prédiction de la phrase suivante) et pourquoi RoBERTa l'a abandonnée ?
Qu'est-ce que LoRA et pourquoi ça fonctionne (hypothèse de rang faible) ?
Qu'est-ce que le meta-prompting et quels sont ses cas d'utilisation?
Pourquoi faut-il mettre bias=False dans les couches linéaires des LLM modernes?
Qu'est-ce que le cross-encoder QA et quel est le format d'entrée?
Quels sont les problèmes de BERT dans les tâches de génération de texte?
Concevez un système d'assistant vocal avec une faible latence (<500 ms) de bout en bout.
Qu'est-ce que la recherche par faisceau et pourquoi est-elle rarement utilisée pour la génération ouverte ?
Quels formats de compression (binaire, quantification scalaire) existent dans VDB?
Qu'est-ce que la quantification et quels sont les schémas (PTQ, QAT, AWQ, GPTQ, GGUF) ?
Quel est le rôle des filtres payload dans la base vectorielle?
Qu'est-ce que la bulle de filtre et comment la détecte-t-on?
Quelle est l'idée de l'algorithme Byte Pair Encoding (BPE) ? Décrivez les étapes de l'apprentissage.
Qu'est-ce que DocVQA et quels modèles y sont populaires?