Je analyseert de effectiviteit van een medicijn, je hebt het effect alleen gemeten op de patiënten die de studie hebben voltooid. Waarom kan dit verkeerd zijn?
Middle
165
Je analyseert de effectiviteit van een medicijn, je hebt het effect alleen gemeten op de patiënten die de studie hebben voltooid. Waarom kan dit verkeerd zijn?
Welke algoritme is minder gevoelig voor overfitting: een bos van ondiepe bomen of een bos van diepe bomen?
Waarom kan een lijst niet worden gebruikt als een sleutelwaarde in Python, maar een tuple wel?
Heb je ervaring met uplift-modellering?
Als je een van de vectoren met 10 vermenigvuldigt, verandert de cosinussimilariteit dan?
Met welke gradient boosting tools heb je gewerkt? CatBoost, LightGBM, XGBoost?
Hoe goed ken je Python?