Machine Learning / AI
Quels sont les méthodes de régularisation pour les modèles non linéaires?
Qu'est-ce que la calcul différé dans Spark?
Qu'est-ce que l'échantillonnage de Thompson et UCB?
Comment décider de la fonction de perte pour un modèle du point de vue des affaires et des données?
Qu'est-ce que OSM et comment en extraire des étiquettes?
Comment augmenter la vitesse lors du test sans réentraîner le modèle?
Qu'est-ce que la quantification en apprentissage automatique ? Comment se fait la quantification de FP32 à INT8 — d'un nombre à virgule flottante à un entier ?
Qu'est-ce que la NSP (prédiction de la phrase suivante) et pourquoi RoBERTa l'a abandonnée ?
Quelle est la différence entre les métriques NDCG et Accuracy ? Laquelle est la plus importante pour le fil d'actualités ?
Comment effectuer la binarisation des facteurs, par exemple l'âge?
Quelles méthodes peuvent être utilisées pour la génération d'images (GAN, VAE, diffusion, autorégressifs) ? Avantages et inconvénients de chacun.
Quelle est la différence entre le échantillonnage top-k et le échantillonnage top-p (noyau) ?
Comment un agent doit-il travailler avec un schéma d'outils très volumineux (sélection de fonctions) ?
Qu'est-ce que NGBoost et les prédictions probabilistes?
Qu'est-ce qu'une couche de goulot d'étranglement et à quoi sert-elle?
Qu'est-ce que le CUPED et comment réduit-il la variance?
Quels sont les pièges de l'AutoML en production (reproductibilité) ?
Qu'est-ce que DeepSpeed ZeRO Stage 1, 2, 3 ?
Quelles sont les erreurs de type I et II?
Avez-vous déjà été confronté à un décalage de données?