Machine Learning / AI
Wat zijn lazy berekeningen in Spark?
Hoe train je het model? Beschrijf het algoritme voor het bijwerken van de gewichten.
Wat is beam search en waarom wordt het zelden gebruikt voor open-ended generatie?
Hoe neem je een beslissing over de keuze van de verliesfunctie voor het model vanuit zakelijk en data perspectief?
Wat zijn gemaskeerde autoencoders (MAE) voor CV?
Welke verdelingen bestaan er en waar worden ze toegepast?
Wat is OSM en hoe labels eruit halen?
Hoe verhoog je de snelheid tijdens de test zonder het model opnieuw te trainen?
Wat is NSP (volgende zin voorspelling) en waarom heeft RoBERTa het afgewezen?
Welke use-cases van uplift in marketing (doelgroep)?
Wat is het verschil tussen de metrics NDCG en Accuracy? Welke is belangrijker voor de nieuwsfeed?
Hoe maak je factoren binariseer, bijvoorbeeld leeftijd?
Wat is re-ranking en cascade-architectuur van een zoekmachine?
Wat is het verschil tussen top-k sampling en top-p (nucleus) sampling?
Wat is gestratificeerde sampling in experimenten?
Wat is een bottleneck-laag en waar wordt deze voor gebruikt?
Hoe voer je cross-validatie uit op tijdreeksen?
Wat is CUPED en hoe vermindert het de variantie?
Welke valkuilen zijn er bij AutoML in productie (reproduceerbaarheid)?
Wat zijn DeepSpeed ZeRO Stage 1, 2, 3?