Como funciona uma floresta aleatória e quais são as suas vantagens e desvantagens?
Machine Learning / AI
O que fazer com dados de granularidade temporal diferente: alguns são registrados a cada hora, outros diariamente?
O que é uma estimativa duplamente robusta?
O que é Delta Lake / Iceberg / Hudi e por que lakehouse?
Qual foi o volume final da amostra e quantos atributos originais e selecionados havia no projeto?
Fala mais sobre a sua experiência end-to-end: quais as etapas que você realizou desde a definição do problema até à implementação do modelo em produção?
O que é over-squashing em GNN?
Que exemplos de feature engineering realizaste nos teus projetos?
Por que é comum usar árvores pouco profundas no boosting e como o número de árvores afeta o overfitting?
Calcular o valor total de receita para cada utilizador Encontrar a primeira e a última data de compra de cada utilizador
Como pode modificar a funcionalidade do erro?
O que é NGBoost e previsões probabilísticas?
Calcular a soma total de receita (revenue) para cada utilizador
O que são usuários de holdout e por que manter um controle constante?
O que é um ataque de inversão de modelo?