Comment utiliser BERT dans une tâche QA de style SQuAD?
Machine Learning / AI
Quelles caractéristiques sont utilisées dans les modèles NLP classiques (TF-IDF, n-grammes, n-grammes de caractères) ?
Comment réduire la taille du cache KV (GQA, MQA, fenêtre glissante) ?
Quelles tâches Deepgram résout-il et quelles sont les fonctionnalités de son API ?
Quels problèmes rencontre RLHF en pratique (piratage de récompenses, effondrement de mode) ?
Comment choisir le format de quantification pour l'inférence sur CPU vs GPU?
Qu'est-ce que le softmax échantillonné et quel est son avantage en termes de calcul?
Qu'est-ce qu'EfficientDet ?
Quels hyperparamètres HNSW sont importants (M, efConstruction, efSearch) ?
Quelle est la différence entre la récupération sparse (BM25) et la dense?
Quelles techniques d'inférence en streaming pour la reconnaissance vocale (attention segmentée, anticipation) ?
Qu'est-ce que les cartes d'activation de classe (CAM) et Grad-CAM?
Qu'est-ce que DeepSORT et ByteTrack pour le suivi multi-objet ?
Comparez la classification, la localisation et la détection.
Quelles sont les caractéristiques de la détection en vidéo en temps réel (TensorRT, batch=1) ?