Quels problèmes rencontrés lors des tests A/B des modèles ML (boucle de rétroaction des données d'entraînement) ?
Machine Learning / AI
Comment évaluer la qualité de la récupération dans RAG (recall@k, hit@k, MRR) ?
Qu'est-ce que la classification d'intention et le remplissage de slots dans la recherche ?
Concevez un système d'évaluation de la pertinence des résultats de recherche avec LLM-judge.
Quelles sont les principales différences entre GloVe et word2vec?
Avec quel outil aimais-tu le plus travailler?
Comment organiser l'évaluation humaine des réponses LLM dans une équipe?
Quelles sont les solutions AutoML populaires (H2O, AutoGluon, FLAML, AutoKeras) ?
Quelles sont les caractéristiques de l'apprentissage actif dans les tâches de NLP?
Qu'est-ce que l'approche BERT-as-a-reranker?
Avec qui communiques-tu le plus souvent au travail?
Qu'est-ce que le batching continu et en quoi est-il meilleur que le batching statique?
Qu'est-ce qu'un agent LLM ? En quoi diffère-t-il d'un pipeline de prompt-chain ?
Quelle est la différence entre DiT (Diffusion Transformer) et U-Net en diffusion?
Quelle est la différence entre les modèles de langage autoregressifs et masqués?
Qu'est-ce que le rang moyen récproque (MRR) et où est-il utilisé dans l'évaluation de la recherche?