Vertel me over TF-IDF: hoe werkt het, hoe ziet de uiteindelijke matrix eruit?
Machine Learning / AI
Op welke ongeveer salarisrange richt je je voor de overgang?
Hoe kunnen hyperparameters worden afgesteld?
Wat is graph RAG en in welke taken is het effectief?
Hoe houd je rekening met de tijd tussen aankopen voor de relevantie van producten?
Welke metriek kiezen voor regressie met uitschieters: MSE of MAE?
Welke verliesfunctie (loss) wordt standaard gebruikt bij lineaire regressie?
Hoe gebruik je collaboratieve methoden voor aanbevelingen op basis van embeddings?
Waarom wordt de analytische formule voor lineaire regressie niet in de praktijk gebruikt?
Vertel over regularisatie in klassieke ML-algoritmen: L1 en L2. Wat zijn hun eigenschappen en verschillen?
Welke splitsingscriteria worden gebruikt in beslissingsbomen (bijvoorbeeld entropiecriterium)? Kunt u andere noemen?
Hoe verschilt stochastisch gradient descent van de klassieke?
Waarom moet de LEAD-functie worden gebruikt om toekomstige waarden op basis van id in SQL te zoeken?
Hoe gaan we de parameters afstemmen in gradient boosting? Welke parameters zijn er en wat ga je als eerste aanpassen?
Welke bedrijfs- en tegenmetriek moeten worden gemeten om de widget voor productpromotie te evalueren?
Hoe zijn coroutines en event loop in Python opgebouwd?
Welke foutdrempel moet worden gebruikt om de training te stoppen?
Hoe werkt dropout tijdens training en inferentie?
Waarom werkt bagging met bomen, zoals in een willekeurig bos?