Machine Learning / AI
Hoe evalueer je de kwaliteit van retrieval in RAG (recall@k, hit@k, MRR)?
Wat is de volledige trainingspipeline van het model?
Hoe los je het probleem van ontbrekende benodigde informatie in gegevens op?
Vertel over je ervaring — een korte zelfpresentatie (5-7 minuten).
Vertel in drie zinnen over je rol en projecten bij [organisatie]: rol, belangrijkste prestatie, reden voor vertrek.
Welke moeilijkheden ontstaan er bij het gebruik van Word2Vec en NLTK voor de Russische taal?
Hoe te controleren of LLM-as-a-Judge de kwaliteit correct beoordeelt en hoe deze te kalibreren?
Vertel over het idee van Longformer en zijn sparse aandacht.
Wat is OPQ en waarom is het beter dan PQ?
Wat is de betekenis van anchor in Triplet Loss?
Hoe ziet een typische werkdag van een ontwikkelaar eruit?
Wat is DistilBERT? Welke kwaliteitsverliezen en snelheidswinst zijn er?
Wat is exponential backoff bij retries in Airflow?
Hoe maak je een train/val/test split en een benchmark? Hoe verdeel je de gegevens correct?
Hoe verdeel je tekst automatisch in betekenisvolle stukken zonder gebruik te maken van LLM?
Wat is Performer en wat is het idee achter de random features benadering?
Vertel me in het algemeen hoe je hebt gewerkt op je laatste werkplek (DOM.RF), waar je verantwoordelijk voor was, hoe je werkdag verliep, welke huidige taken er zijn voor het project CorpGPT (bedrijfs-RAG)?
Wat is examenkans?
Hoe helpt de cosinusafstand bij het meten van de semantische nabijheid van vectoren?
Wat is retrieval met een hybride score (dense + sparse) en waarom mengen?