Machine Learning / AI
Qu'est-ce que l'expansion de requête RM3 ?
Parle-moi du ROC-AUC : qu'est-ce que c'est et comment est-ce utilisé ?
Qu'est-ce que la fonction de risque?
Dans une tâche de prévision de séries temporelles où la cible comporte des zéros ou des valeurs faibles, quelle métrique de qualité est préférable d'utiliser : MAPE, SMAPE ou WAPE ?
Qu'est-ce que la probabilité d'examen?
Quelles techniques empêchent l'oubli catastrophique lors du fine-tuning?
Quelles techniques d'inférence en streaming pour la reconnaissance vocale (attention segmentée, anticipation) ?
Parlez-nous de l'agent Text-to-SQL : architecture, pipeline, technologies.
Qu'est-ce que la confidentialité différentielle et quelle est la définition (epsilon, delta) ?
Qu'est-ce que la distillation de connaissances pour l'edge?
Quelles stratégies de sélection de requêtes (incertitude, diversité, réduction de l'erreur attendue) ?
Qu'est-ce qu'un modèle génératif de labels dans Snorkel?
Décrivez la boucle d'entraînement pour la classification binaire avec un réseau neuronal (linéaire -> relu -> linéaire -> sigmoïde). Quelle fonction de perte choisir ?
Qu'est-ce que la prédiction grasp et quelles sont les approches?
Quelles métriques connaissez-vous pour évaluer un système LLM dans son ensemble?
Qu'est-ce que le critère de Gini et comment est-il utilisé dans la construction d'arbres de décision?
Comment le modèle SBERT avec triplet loss est-il entraîné?
Comment implémenter un tri par date avec une précision jusqu'à la milliseconde en SQL?
Qu'est-ce que la récupération basée sur l'embedding en production (FAISS, ScaNN) ?
Dans quelles situations est-il préférable d'utiliser numpy et dans quelles autres les structures de données standard de Python?