Machine Learning / AI
La taille de l'échantillon est-elle suffisante pour effectuer les tests?
Quels pièges surgissent lors de RAG dans un scénario de chat (contexte de dialogue, historique) ?
Quelles métriques d'évaluation des dialogues (BLEU, perplexité, évaluation humaine) sont utilisées ?
Qu'est-ce que LangGraph, à quoi sert-il, comment sont implémentées les branches et les sauts conditionnels ? En quoi les outils diffèrent-ils des nœuds ?
Imaginez que vous travaillez avec un modèle en PyTorch et qu'après l'avoir mis en mode évaluation eval(), vous constatez que les métriques sur un ensemble de test fixe de 10 000 exemples changent à chaque exécution. Vous fixez l'état initial des générateurs de nombres aléatoires pour la reproductibilité : où d'autre pourrait se cacher la source des changements ? Expliquez le rôle de Dropout, BatchNorm et torch.no_grad() et nommez les métriques avec des seuils pour vérifier la stabilité des résultats.
Comment organiser la collecte automatique de données et la formation avec Airflow?
Raconte-moi plus en détail comment était organisé le pipeline du système RAG (filtrage, re-ranking), ce que tu as fait personnellement et ce que tes collègues ont fait?
Pourquoi désactive-t-on le dropout lors de l'inférence?
Qu'est-ce que le RVQ (quantification vectorielle résiduelle) dans un codec audio?
Quels sont les problèmes d'équité en apprentissage automatique en médecine?
Qu'est-ce que la courbe ROC et comment est-elle utilisée pour évaluer les classificateurs?
Vos modèles, où étaient-ils situés (infrastructure de déploiement) ?
Que se passe-t-il si vous appelez max au lieu de idxmax pour rechercher la valeur maximale?
Quel est le conflit entre différentes définitions de l'équité?
Comment traiter un flux de données pour calculer la médiane avec une mémoire limitée?
Qu'est-ce que SARSA et en quoi diffère-t-il du Q-learning?
Qu'est-ce qu'une connexion résiduelle et à quoi sert-elle?
Quelle est la dimension des logits et comment en obtenir un token ?
Quels problèmes surviennent lors de l'initialisation des poids à zéro ? Quelles méthodes d'initialisation (Xavier, He) résolvent ces problèmes ?
Pourquoi la fonction renvoie-t-elle 0 lorsqu'il n'y a qu'une seule classe dans l'échantillon?