Como implementar tecnicamente um sistema de armazenamento de dados e alertas para monitorização do modelo?
Machine Learning / AI
Como o random forest e o boosting de gradiente são semelhantes e diferentes? Como são construídos as árvores em cada um?
Tem ideias para melhorar ainda mais o sistema de previsão de demanda?
Conte como o algoritmo de clustering que utilizou funcionava — como agregava os pontos no espaço?
Como determinou a qualidade do clustering? Que métodos utilizou?
Relativamente ao Spark — que tarefas específicas foram paralelizadas nele?
O que é uma série temporal estacionária, como verificá-la e por que é importante?
Caso: desenvolvimento de um sistema de preços para a classe de negócios da S7. 300 voos por dia, ~100 com classe de negócios, 4-6 lugares. Dois objetivos: máxima ocupação e máxima receita. Preços atualizados diariamente e após cada compra. Atualmente, os preços são definidos manualmente, com base na ocupação. Como abordaria esta tarefa?
Qual é a diferença entre um intervalo de confiança e um intervalo de previsão? O que eles mostram?
Como construir um sistema de rastreamento de qualidade e tomada de decisão sobre a substituição do modelo?
Que modelos utilizou para a previsão de procura?
Fale-nos sobre a sua experiência em Data Science
Como lidar com um baixo volume de feedback em rotas tranquilas (poucos voos, dados ruidosos)?
Fale sobre casos interessantes de otimização no Spark relacionados com características e junções complexas
Como resolver o problema dos dados históricos deslocados (os preços estavam subvalorizados, o modelo vê mal a procura em novos níveis)?