Machine Learning / AI
Quelle est la différence entre zero-shot et few-shot prompting?
Qu'est-ce que la classification d'intention et quelles sont les approches?
Pourquoi utilise-t-on généralement des arbres moins profonds dans le boosting par gradient que dans la forêt aléatoire?
Quels modèles de reconnaissance de chaînes (CRNN, TrOCR) ?
Qu'est-ce que le boosting ordonné dans CatBoost?
Quelle est la différence entre la multitâche et le multiprocessus?
Quels types d'index existent?
Qu'est-ce que TF-IDF?
Quelles raisons peuvent conduire à des valeurs différentes de la fréquentation quotidienne moyenne d'un service web par différents analystes?
Quelle est la différence entre le boosting et le bagging (Random Forest) ? Comparez leur tendance à surajuster.
Quelles doivent être les caractéristiques d'un objet pour qu'il soit un itérateur en Python?
Qu'est-ce que la quantification NF4 dans QLoRA?
Quelles techniques de compression de prompt connaissez-vous (LLMLingua) ?
Qu'est-ce qu'un index inversé et quelles structures de données sont utilisées?
Quels sont les méthodes modernes efficaces pour les séries temporelles?
Qu'est-ce que le biais et la variance, et qu'est-ce qui diminue dans une forêt aléatoire?
Pourquoi faut-il mettre bias=False dans les couches linéaires des LLM modernes?
Qu'est-ce qu'une variable instrumentale?
Comment extraire des valeurs uniques par colonne en SQL?
Parlez-moi de la tâche de traduction automatique. Qu'est-ce que sequence-to-sequence?