Wat is 3D parallelisme (gegevens + tensor + pipeline)?
Machine Learning / AI
Wat is stacking en blending?
Hoe formuleer je een metriek die rekening houdt met de winstverwachting en de verkoopkans per categorie?
Hoe bepaal je of producten samen zijn gekocht en complementair zijn?
Hoe train je met een grote batch met beperkte geheugen?
Waarom wordt er bij het bijwerken van gewichten gebruik gemaakt van vergelijking met epsilon?
Wat is gradient boosting?
Vertel over regularisatiemethoden en het bestrijden van overfitting in Deep Learning (Dropout, Batch Normalization, Early Stopping, Elastic Net).
Wat is Elastic Net?
Hoe waarborg je de gegevensbeveiliging bij RAG (PII, toegangsrechten)?
Wat is buurtaggregatie en welke functies worden gebruikt (gemiddelde, som, max, LSTM)?
Hoe toon je het actuele adres en de prijs voor elke advertentie in SQL?
Hoe zoek je efficiënt naar vergelijkbare embeddings onder miljoenen producten met behulp van Faiss of andere indexen?
Welke regularisatiemethoden bestaan er voor niet-lineaire modellen?
Hoe verhoog je de snelheid tijdens de test zonder het model opnieuw te trainen?
Wat is de doelvariabele van de n-de boom in gradient boosting?
Wat zijn de moderne benaderingen voor tabelgegevens (CatBoost, LightGBM, XGBoost, deep tabular)?
Hoe kunnen hyperparameters worden afgesteld?