Machine Learning / AI
Qu'est-ce que BERTScore et pourquoi est-il meilleur que BLEU pour l'évaluation de la génération?
Qu'est-ce que CUTLASS?
Qu'est-ce que la Reconnaissance d'Entités Nommées (NER) ? Quelle annotation est la plus couramment utilisée (BIO, BIOES) ?
Quelle structure de données est à la base du dict en Python ? Comment les collisions sont-elles résolues ?
Que faire avec le jeu de données avant de former le modèle?
Quelles méthodes de sélection de caractéristiques existent?
Le coefficient de corrélation est égal à 0. Peut-on affirmer que les échantillons sont indépendants ? Pourquoi ?
Peut-on utiliser (1, [1, 2]) comme clé dans un dictionnaire en Python ? Pourquoi ?
Qu'est-ce que le bagging et pourquoi réduit-il la variance du modèle?
Qu'est-ce que la convolution séparée en profondeur et où est-elle utilisée (MobileNet) ?
Qu'est-ce que la gestion de versions des données et comment comparer DVC, LakeFS, lakeFS?
Qu'est-ce que l'impact différentiel?
Parlez-moi de l'algorithme hongrois. Où est-il utilisé en ML?
Peux-tu expliquer la différence entre cross-encoder et bi-encoder?
Dans quel ordre énumérer les champs dans un index lors de la jointure par date, id et champ booléen?
Une convolution atrous (dilatée) peut-elle ne jamais utiliser un pixel dans l'image d'origine?
Qu'est-ce que Faiss et comment est-il conçu?
Avez-vous travaillé avec Apache Spark?
Comment fonctionne la suppression non maximale (NMS) et à quoi sert-elle?
Quels pièges peuvent survenir lors de la normalisation des données pour résoudre le problème d'extrapolation dans une forêt aléatoire?