Machine Learning / AI
Hoe vind je de laatste aankoop per persoon in de gegevens?
Welke metrics zou je gebruiken om het toewijzingssysteem voor leads aan agenten te beoordelen?
Heb je dit allemaal zelf gedaan (RAG, LoRA, werken met neurale netwerken) of heb je iemand geholpen?
Bereken de totale omzet (inkomsten) voor elke gebruiker Vind de eerste en laatste aankoopdatum voor elke gebruiker
Hoe zou je nu (met je huidige kennis) het classificatie- en routeringsprobleem in een service desk aanpakken, met een meerlagige aanpak: rule-based → ML → LLM fallback → mens? Noem specifieke technologieën, modellen en metrics.
Vertel over het verschil tussen multitasking, multiprocessor en asynchroniteit
Wat is LayoutLM en hoe verschilt het van BERT voor documenten?
In de dialoogtabel staan 80 miljoen berichten, en de analytische query voor de beoordelingsset duurt 25 minuten en geeft soms dubbele vraag-antwoordparen terug. Wat zou je als eerste corrigeren en waarom?
Bereken de F1-score voor een model dat altijd 0 voorspelt, met een steekproef van 90 nullen en 10 enen.
Je hebt niet gewerkt met computer vision (OpenCV, YOLO). Hoe interessant zou het zijn om dat te begrijpen?
Waarom wordt de VGG-architectuur tegenwoordig niet gebruikt?
Hoe gaan we de dataset samenstellen om deze ranker te trainen?
Wat is DSSM, weet je dat?
Zijn er vragen over het product en de taken die het bedrijf oplost?
Zijn er cursussen geweest over optimalisatiemodellen?
Hoe verdeel je gegevens in groepen met behulp van vensterfuncties in SQL?
Je hebt een kleine dataset met filmrecensies in het Russisch en hun binaire sentimentlabel (labels: 0 — negatief, 1 — positief). Jouw taak is om binnen 15 minuten een volledige pipeline te implementeren voor het trainen van een eenvoudig tekstclassificatiemodel zonder gebruik te maken van vooraf getrainde encoders zoals BERT, en de nauwkeurigheid (accuracy) op deze gegevens te tonen. reviews = [ "Deze film is gewoon geweldig!", "Verschrikkelijk acteerwerk en saai verhaal.", "Ik heb van elk moment genoten!", "De slechtste film die ik heb gezien.", "Uitstekend camerawerk en geweldig verhaal.", "Onverdraaglijk saai en voorspelbaar." ] labels = [1, 0, 1, 0, 1, 0]
Wat is de stationariteit van een reeks en hoe controleer je dat (ADF-test)?
Wat zijn de kenmerken van het trainen van GNN op grote grafen (mini-batch sampling, cluster-GCN)?
Wat is Apache Beam / Dataflow?