Machine Learning / AI
Comment trouvez-vous le format de travail — deux fois par semaine au bureau?
Pourquoi cette approche a-t-elle été choisie (SentenceTransformer + similarité cosinus) ?
FROM python:3.11 COPY ./app WORKDIR /app RUN pip install torch transformers fastapi uvicorn sentence-transformers CMD ["uvicorn", "main:app", "--host", "0.0.0.0"]
Comment trouver le dernier achat par personne dans les données?
Qu'est-ce qu'une matrice de Jordan?
Est-ce que tu as fait tout cela toi-même (RAG, LoRA, travail avec des réseaux neuronaux) ou as-tu aidé quelqu'un ?
Après l'ID du token et les embeddings, qu'est-ce qui arrive exactement dans le décodeur : quelle est la forme des représentations, comment l'information positionnelle est-elle ajoutée et que se passe-t-il ensuite ?
Parlez de votre expérience chez 1C-Rarus, gestion des demandes dans Service Desk. Est-ce un helpdesk pour les clients?
Quel outil a été utilisé pour le découpage structurel des documents?
Comment vérifiez-vous généralement la qualité et la pertinence des données avant de former LoRA?
Parle-moi de ton expérience du travail à distance — entièrement à distance ou y avait-il des bureaux?
Pourquoi avoir choisi la recherche hybride BM25 + embeddings au lieu de la seule distance cosinus?
Parlez-moi de la différence entre multitraitement, multiprocessus et asynchronie
Pourquoi la normalisation de couche est-elle utilisée dans le transformeur plutôt que la normalisation de lot?
Dans le tableau des dialogues, il y a 80 millions de messages, et la requête analytique pour le jeu d'évaluation prend 25 minutes et retourne parfois des doublons de paires question-réponse. Qu'est-ce que vous corrigeriez en premier et pourquoi?
Qu'est-ce que DocVQA et quels modèles y sont populaires?
Comment évaluez-vous votre niveau de maîtrise de Python et SQL?
Qu'est-ce qu'une époque (epoch) ?
Combien de personnes dans l'équipe?
Vous n'avez pas travaillé avec la vision par ordinateur (OpenCV, YOLO). À quel point serait-ce intéressant à comprendre?