Machine Learning / AI
Quelles fonctionnalités principales ont été utilisées pour la classification du spam dans les leads?
Qu'est-ce que la préférence par paire et comment la calculer?
Quelles métriques conviennent pour évaluer la qualité d'un modèle de classification binaire?
Différences architecturales entre XGBoost, LightGBM et CatBoost : comment les arbres sont-ils construits ?
Peut-on ajouter un champ à la table au lieu d'utiliser une requête SELECT?
Pourquoi les poids du modèle peuvent-ils devenir grands et pourquoi faut-il les réduire par régularisation?
Quelles métriques sont utilisées pour la segmentation et la détection d'objets?
Faisiez-vous des solutions pour les clients de l'employeur — ils les prenaient et les maintenaient eux-mêmes?
Quelles sont les embeddings obsolètes et comment y faire face?
Pourquoi BERT donne-t-il une meilleure qualité sur les tâches de classification de texte que TF-IDF avec régression logistique?
Comment créer et entraîner un classificateur dans PyTorch?
Comment fonctionne la tokenisation ? Pourquoi utilise-t-on des sous-mots plutôt que des mots entiers ?
Pourquoi utiliser des listes pour stocker les valeurs précédentes?
Qu'est-ce que le cosinus par rapport au produit scalaire et à la distance euclidienne — comment la normalisation influence-t-elle ?
Comment former un grand lot avec une mémoire limitée?
Comment travailler avec des données incomplètes provenant de différents serveurs et tables?
Un dropout a-t-il été effectué en se basant sur la perte ou en éliminant aléatoirement des poids?
Parlez-moi de votre expérience en analyse de données, projets et cours.
Qu'est-ce que le remplissage de slots et comment la tâche est-elle formulée?
Qu'est-ce que BatchNorm ?