Está a analisar a eficácia de um medicamento, mediu o seu efeito apenas nos pacientes que concluíram o estudo. Por que isso pode estar incorreto?
Middle
192
Está a analisar a eficácia de um medicamento, mediu o seu efeito apenas nos pacientes que concluíram o estudo. Por que isso pode estar incorreto?
Qual algoritmo é menos propenso a overfitting: uma floresta de árvores rasas ou uma floresta de árvores profundas?
Por que não se pode usar uma lista como chave de dicionário em Python, mas uma tupla pode?
Tem experiência com modelagem uplift?
Se multiplicar um dos vetores por 10, a similaridade do cosseno vai mudar?
Com que ferramentas de gradient boosting trabalhou? CatBoost, LightGBM, XGBoost?
Quão bem conhece Python?