Machine Learning / AI
Welke bibliotheken gebruiken voor het zoeken naar dichtstbijzijnde buren?
Vertel over de taak van automatische vertaling. Wat is sequence-to-sequence?
Wat betekenen de TF- en IDF-componenten?
Beschrijf de taak van het groeperen van aangrenzende getallen in bereiken.
Hoe bereken je de steekproefgrootte voor een A/B-test?
Welke typen modellen kent u voor detectietaken (familie R-CNN, YOLO, SSD, DETR)?
Wat zijn generatieve modellen voor moleculen?
Hoe formuleer je een metriek die rekening houdt met de winstverwachting en de verkoopkans per categorie?
Welke oplossingen moeten worden genomen bij een tekort aan middelen voor het verwerken van vertraagde verzoeken?
Welke regularisatiemethoden bestaan er voor niet-lineaire modellen?
Wat zijn lazy berekeningen in Spark?
Wat zijn Thompson sampling en UCB?
Hoe neem je een beslissing over de keuze van de verliesfunctie voor het model vanuit zakelijk en data perspectief?
Wat is OSM en hoe labels eruit halen?
Hoe verhoog je de snelheid tijdens de test zonder het model opnieuw te trainen?
Wat is kwantisatie in machine learning? Hoe gebeurt de kwantisatie van FP32 naar INT8 — van een floating-point getal naar een geheel getal?
Wat is NSP (volgende zin voorspelling) en waarom heeft RoBERTa het afgewezen?
Wat is het verschil tussen de metrics NDCG en Accuracy? Welke is belangrijker voor de nieuwsfeed?
Hoe maak je factoren binariseer, bijvoorbeeld leeftijd?
Welke methoden kunnen worden gebruikt voor het genereren van afbeeldingen (GAN, VAE, diffusie, autoregressief)? Voordelen en nadelen van elk.