Machine Learning / AI
Qu'est-ce que LayoutLM et ses versions (v1, v2, v3) ?
Qu'est-ce que PPO et en quoi est-il plus pratique que TRPO en pratique?
Comment gérer les valeurs manquantes dans le jeu de données?
Comment diviser les données en strates pour la validation?
Quelles métriques de classification multiclasse connaissez-vous ? Leurs avantages et inconvénients (macro, micro, pondérée).
Quels types de données conviennent comme clé de dictionnaire en Python et pourquoi?
Qu'est-ce que le surapprentissage ? Quelles sont les méthodes pour y faire face ?
Qu'est-ce que la courbe ROC?
Qu'est-ce qu'un modèle de langage vidéo (VideoLLaMA, Video-ChatGPT) ?
Quelle sera la qualité de chaque modèle si l'on supprime le premier arbre construit dans un gradient boosting et une forêt aléatoire de 1000 arbres?
Pourquoi la sigmoïde est-elle rarement utilisée comme fonction d'activation dans les réseaux neuronaux?
Qu'est-ce que HELM et quelles tâches couvre-t-il?
Que se passera-t-il si on supprime le premier ou le dernier arbre dans le boosting?
Qu'est-ce que la multicolinéarité des caractéristiques ? En quoi est-elle dangereuse et comment la détecter ?
Quelle est l'idée mathématique derrière les modèles de diffusion ? Qu'est-ce que le processus forward et reverse ?
Qu'est-ce que les Sentence Embeddings et en quoi diffèrent-ils des word embeddings?
Qu'est-ce que le biais de sélection d'échantillons dans la plateforme d'expérimentation?
Quels sont les modèles TTS modernes (Tortoise, XTTS, StyleTTS2, ElevenLabs) ?
Les paramètres en Python sont-ils passés par valeur ou par référence?
Qu'est-ce que l'analyse de mise en page dans les documents?