Machine Learning / AI
Qu'est-ce que l'AWQ et quelle est l'idée de la mise à l'échelle par canal ?
Qu'est-ce que l'agrégation de voisinage et quelles fonctions utilisent-elles (moyenne, somme, max, LSTM) ?
Qu'est-ce que la rétention des données?
Que retourner en présence ou en absence d'un axe de symétrie?
Quels problèmes rencontrent lors de l'utilisation de FastText pour la segmentation de mots et le stemming?
Comment faire en sorte que le LLM renvoie un JSON strict et valide la réponse?
Comment les tâches sont-elles réparties dans l'équipe?
Qu'est-ce qu'un audit de bias-fairness pour un modèle ML?
Comment déterminer l'axe de symétrie vertical pour une liste de points?
Quels simulateurs utilisent-ils (MuJoCo, Isaac Sim, Gazebo) ?
Qu'est-ce que l'apprentissage compute-optimal selon Chinchilla?
Quel système d'exploitation et quelle configuration de l'ordinateur local utilisez-vous?
Qu'est-ce que la perte de Tversky ?
Qu'est-ce qu'un token dans BERT et quelles sont les options de tokenisation disponibles?
Qu'est-ce que l'over-squashing dans GNN?
Qu'est-ce que la mise à l'échelle NTK-aware RoPE pour étendre la fenêtre de contexte?
Quels sont les avantages et inconvénients de l'utilisation de la validation croisée?
Parlez-moi du modèle d'évaluation de la valeur marchande de l'immobilier : son essence, ses données, son application.
Pourquoi un décodeur est-il utilisé dans GPT plutôt qu'un encodeur?
Quelle fonction de perte est utilisée en régression linéaire?