Parlez-moi de la tâche de traduction automatique. Qu'est-ce que sequence-to-sequence?
Machine Learning / AI
Qu'est-ce que A100, H100, B200 et quelles sont les principales différences architecturales?
Quelle est la différence entre MobileNet v2 et v1 (résidus inversés) ?
Qu'est-ce que la fonction de survie S(t) ?
Quels sont les méthodes pour lutter contre le surapprentissage et comment fonctionnent-elles?
Qu'est-ce qu'une connexion de saut et à quoi sert-elle (ResNet) ?
Qu'est-ce que Triton (OpenAI) et où est-il plus pratique que CUDA C++?
Quelles méthodes de détection d'anomalies pour les images (PaDiM, PatchCore) ?
Qu'est-ce que IPO, KTO, ORPO en tant qu'alternatives à DPO?
Qu'est-ce que TGI (text-generation-inference) et quelles sont ses caractéristiques?
Qu'est-ce que le boosting par gradient?
Qu'est-ce que la récupération neuronale-symbolique?
Quelles sont les caractéristiques de l'évaluation en ligne des recommandations (CTR, conversion) ?
Qu'est-ce que la profondeur stochastique et pourquoi est-elle utilisée dans EfficientNet?
Qu'est-ce que HELM et quelles tâches couvre-t-il?
Énumérez les métriques de qualité du modèle de classification binaire et leurs différences?
Qu'est-ce que l'équité en ML et quelles sont les définitions existantes (parité démographique, chances égalisées) ?
Quelle est la différence entre sparse MoE et dense MoE?
Comment traiter un flux de données pour calculer la médiane avec une mémoire limitée?
Qu'est-ce que les processus gaussiens et quelles fonctions kernel utilisent-ils?