Qu'est-ce que la longueur du contexte et pourquoi est-il difficile de l'étendre ?
Machine Learning / AI
Quelles techniques de compression de prompt connaissez-vous (LLMLingua) ?
Quelles sont les causes du surapprentissage?
Qu'est-ce que le surapprentissage et comment le combattre?
Quelles méthodes peuvent être utilisées pour améliorer le modèle?
Qu'est-ce que l'autocorrélation et l'autocorrélation partielle (ACF, PACF) ?
Comment évaluer le temps de réponse médian du service en cas de volume élevé de logs ne tenant pas en mémoire?
Comment choisir les données pour estimer la médiane : parcours séquentiel ou sous-échantillonnage aléatoire ?
Quels sont les types de régularisation et comment fonctionnent-ils?
Pourquoi les poids du modèle peuvent-ils devenir grands et pourquoi faut-il les réduire par régularisation?
Qu'est-ce qu'un buffer de replay d'expérience et à quoi sert-il?
Qu'est-ce que la calibration et pourquoi est-elle importante pour l'équité?
Qu'est-ce que la visualisation de l'espace de caractéristiques d'un modèle CV avec t-SNE/UMAP?
Comment organiser la conteneurisation et le déploiement des modèles?
Qu'est-ce que Medusa et les têtes de prédiction multi-token?
Comment tester un agent LLM (tests déterministes, rejouer, outils simulés) ?
Comment est structurée la solution au problème de recherche d'une paire de nombres avec une somme donnée?
Quels types d'erreurs existent dans les protocoles médicaux et comment les typifier?
Qu'est-ce que NCCL et à quoi sert-il?
Concevez un système OCR + NLP pour traiter les scans de contrats.