Qu'est-ce que la légende d'image et quelles métriques l'évaluent (CIDEr) ?
Machine Learning / AI
Quelles sont les tendances architecturales des modèles de langage de grande taille (LLM) uniquement décodeurs (LLaMA, Mistral, Qwen) ?
Qu'est-ce que l'état de croyance et comment le met-on à jour?
Comment traiter les caractères hiéroglyphiques rares et les emojis dans le tokeniseur?
Qu'est-ce que l'échantillonnage négatif dans l'apprentissage de word2vec et à quoi sert-il?
Quels problèmes rencontre RLHF en pratique (piratage de récompenses, effondrement de mode) ?
Quelles sont les caractéristiques de sécurité lors de la gestion de robots par apprentissage automatique?
Qu'est-ce que le fine-tuning supervisé (SFT) ? Quelles données sont nécessaires ?
Qu'est-ce que Prophet et quels sont ses points forts/faibles?
Quelles sont les tendances modernes dans la formation sur des clusters hybrides GPU+CPU+TPU?
Pourquoi la similarité cosinus est-elle souvent préférée à la distance euclidienne pour la recherche sémantique ?
Parlez-nous du bag-of-words et de ses limitations.
Quelles sont les caractéristiques de l'apprentissage actif en CV?
Qu'est-ce que l'augmentation CopyPaste?
Quelle est la différence entre la validation croisée pour les séries temporelles et la K-Fold classique?