Est-ce que je comprends bien que vous cherchiez d'abord la correspondance minimale (par exemple, la correspondance par paragraphes), puis que vous exportiez simplement tout le document en entier et l'envoyiez dans le contexte du LLM ?
Python
Combien de clients doivent être traités à la fois et comment déterminer la capacité requise (par exemple, avec une base de 5 milliards de clients) ?
Comment ce modèle/service sera-t-il lancé et fonctionnera-t-il, étant donné que le SMS doit être envoyé à un moment précis selon un horaire?
Si c'est une API, qu'y aura-t-il dans le corps de la requête HTTP entrante et que renvoie le modèle?
Un exemple plus simple : envoi de SMS avec une offre pour acheter de la saucisse, mais arrive le jeûne orthodoxe — qu'est-ce qui change alors et à quoi faut-il faire attention ?
Est-il correct de dire qu'il faut surveiller non seulement les métriques de qualité du modèle, mais aussi les données sur lesquelles ce modèle est construit?
La banque [nom] souhaite envoyer des SMS concernant une nouvelle offre hypothécaire uniquement aux clients ciblés, pas à tous. Quel modèle est nécessaire ici et quels aspects sont importants du point de vue commercial?
Nous allons envelopper le modèle dans un conteneur, non?
Que vérifie exactement Kubernetes avant de lancer un service (prêt) ?
Quels modèles de ML, en dehors des LLM, connaissez-vous du point de vue de l'application commerciale?
Quelle est votre expérience avec Kubernetes et Docker?
Selon toi, toutes les métriques statistiques de qualité sont-elles considérées de la même manière, ou y a-t-il des nuances?
Le service du modèle est constamment en panne et une fois par semaine, des clients y sont envoyés — cela ne semble-t-il pas inefficace et que peut-on faire ?
Quelles sont les autres métriques statistiques de qualité du modèle ?
Que se passe-t-il avec les données après que le modèle les a évaluées?
Que faut-il vérifier/surveiller d'autre lors de l'exécution d'un job batch, en plus de respecter la deadline?
Comment déterminons-nous la capacité d'infrastructure requise pour le modèle?
Comment le modèle sera-t-il déployé précisément — par exemple, sur une machine virtuelle ? Où exactement ?
Le taux de la Banque centrale change, par conséquent, les conditions du prêt (montant, taux) changent — qu'est-ce qui peut changer dans le modèle/campagne à ce sujet?
Comment le modèle interagit-il avec les données lorsqu'il est déjà en production?