Machine Learning / AI
Quel était le toolcalling : natif ou via prompt (parsing) ?
Y a-t-il eu d'autres difficultés techniques avec les hallucinations?
Qu'est-ce que le dropout et comment fonctionne-t-il pendant l'entraînement et l'inférence?
Calculer la somme totale des revenus (revenue) pour chaque utilisateur Pour chaque utilisateur, trouver sa première et sa dernière date d'achat Ajouter une nouvelle colonne prev_revenue au DataFrame, qui contient le revenu de l'achat précédent de cet utilisateur (décalage au sein du groupe). Si pas de précédent, mettre NaN
Parle-moi d'un projet avec du ML classique (pas LLM) dont tu es fier.
Comment un modèle linéaire gère-t-il la multicolinéarité des caractéristiques?
Comment Recall et Precision sont-ils liés, peut-on augmenter l'un sans diminuer l'autre ? Donnez des exemples de tâches.
Comment abordez-vous le choix des hyperparamètres pour le modèle?
Décrivez le cycle de l'agent ReAct : quelles étaient les étapes et comment se terminait le cycle ?
-- 1.1 Que va afficher la requête: SELECT campaign, COUNT(*) as rows, COUNT(DISTINCT co.user_id) AS users FROM campaigns AS ca INNER JOIN communications AS co ON ca.campaign = co.campaign GROUP BY ca.campaign AS campaign -- 1.2 Comment la réponse changera-t-elle si on change le type de JOIN en LEFT? -- 1.3 Indiquez l'ordre d'exécution des opérateurs dans cette requête. -- 2. La table campaigns a été corrigée : suppression des doublons, ajout d'une clé (PK). -- Plus de campagnes ont été menées, en raison de bugs, des tentatives de livraison de communications ont échoué pour certains utilisateurs, et pour d'autres, cela n'a pas été affiché du tout. -- Sur les campagnes promotionnelles envoyées aux utilisateurs : -- 2.1 Écrivez une requête qui affiche le nombre d'utilisateurs ayant reçu avec succès la communication pour chaque campagne. -- 2.2 Modifiez la requête pour afficher : le nombre d'utilisateurs n'ayant reçu aucune communication réussie, pour chaque campagne.
Qu'est-ce que la décodification spéculative et comment fonctionne-t-elle?
Sur quoi vous basez-vous pour déterminer la fourchette de revenus?
Nommez les méthodes classiques d'obtention d'embeddings de mots (Word2Vec, FastText, TF-IDF, N-grammes, etc.).
Quelles sont vos préférences ou restrictions concernant les projets et les domaines thématiques?
Peux-tu expliquer simplement la différence entre Recall et MRR ?
Qu'est-ce que la normalisation par lot ?
Pour une requête, est-ce qu'une des 12 000 réponses suffit ou plusieurs?
Raconte-moi quel projet tu as mené lors de ton dernier emploi, ce que tu faisais, quelle était ta part?
Trade-off biais-variance pour la méthode k plus proches voisins (kNN) lorsque k=1 et lorsque k est grand.
Pourquoi pensez-vous partir maintenant?