Machine Learning / AI
Quels critères de partitionnement sont utilisés dans les arbres de décision (par exemple, critère d'entropie) ? Pouvez-vous en nommer d'autres ?
Calculer le montant total des revenus pour chaque utilisateur Trouver la première et la dernière date d'achat de chaque utilisateur
Après l'ID du token et les embeddings, qu'est-ce qui arrive exactement dans le décodeur : quelle est la forme des représentations, comment l'information positionnelle est-elle ajoutée et que se passe-t-il ensuite ?
ROC-AUC est égal à 0,8. Comment cela changera-t-il si on multiplie le score par 1,25 ?
Créez une nouvelle colonne salary_category dans DataFrame basée sur la valeur du salaire (élevé/faible)
Recommandations de blocs sur la page d'accueil du service de streaming en ligne Élaborez un plan pour résoudre la tâche produit, depuis l'examen des données requises jusqu'à l'entraînement, le test et la mise en œuvre du modèle (ou, si possible, sans ML - sans modèle). Il y a une page d'accueil dans le service de streaming en ligne. Elle est composée de différents blocs. Il existe un catalogue de blocs. Les blocs peuvent contenir différentes quantités de contenu. Il existe un système de recommandation de films prêt, c'est-à-dire un catalogue de films trié par pertinence. Il faut concevoir un système de recommandation personnalisé de blocs et un algorithme pour son application, qui respecte la règle commerciale : afficher un contenu sur la page principale une seule fois.
L'LLM fonctionnait-elle comme un RAG dynamique?
Quelles sont vos attentes en matière de salaire?
Qu'est-ce que LayoutLM et en quoi diffère-t-il de BERT pour les documents?
Est-il plus pratique pour vous de travailler par IP ou par TК?
Qu'est-ce que la régularisation L1 et L2 et pourquoi la L1 peut-elle mettre à zéro les poids?
Pour générer des questions, le grand modèle linguistique a du mal à maintenir le style sur des sujets rares. L'assistant IA propose de lancer immédiatement LoRA sur l'ensemble du corpus historique de 2 millions de dialogues, mais l'annotation est partiellement bruyante. Dans quels cas ne feriez-vous pas confiance à ce conseil et que choisiriez-vous en premier?
Décrivez votre agent analytique : que faisait-il, pour qui, à quoi ressemblait le processus de travail de l'utilisateur ?
Avez-vous travaillé avec des graphiques?
Comment as-tu effectué le déploiement Blue-Green?
Quel modèle d'embedding choisir pour RAG?
Quel type d'attention permet de réduire la complexité en dessous de O(n²) ?
Dans quelle mesure la certification informatique de l'entreprise est-elle importante ou critique pour vous?
Comment entraînons-nous le modèle de classification des phonèmes ? Qu'y a-t-il dans la cible ?
Avez-vous eu des modèles tabulaires en production?