Data Analyst
O modelo de monitorização começou a marcar transações normais como suspeitas (falsos positivos). O que vais fazer?
O que é um gerador?
ORDER BY e PRIMARY KEY no ClickHouse — qual é a diferença, por que estão separados?
Fale mais sobre a regularização L1 e L2
Tarefa 2. JOIN de tabelas Requisito: Obter uma lista de todos os clientes (por ordem alfabética), independentemente de terem créditos ou não, e adicionar a cada cliente um campo total_loan_amount – a soma total de todos os seus créditos. Se um cliente não tiver créditos, exibir 0. Saída – três colunas: client_id, client_name, total_loan_amount.
Como tornar uma classe de utilizador adequada para ser usada como chave de dicionário?
Que tipos de dados podem ser usados como chave em um dicionário em Python?
Para onde gostaria de evoluir a seguir (BI, análise, engenharia)?
Qual é a complexidade da sua solução para o problema de agrupamento de anagramas?
Por onde começarias nesta posição, com que desafios te depararias, que objetivos estabelecerias, com quem te apresentarias em primeiro lugar?
O indicador 'custo do Bitcoin ontem' é normal para uma floresta aleatória e com que problemas pode-se deparar?
O que é semi-join e anti-join? Para que servem e onde aplicar?
Faz sentido treinar gradient boosting em modelos lineares em vez de árvores?
Já teve alguma vez que defender as suas ideias e argumentar a utilidade de uma funcionalidade perante os seus superiores ou o Product Owner?
É possível resolver o problema de forma mais simples, sem PERCENTILE_CONT? Por exemplo, usando ROW_NUMBER?
Fale sobre a lógica do cálculo do Relatório 2: os atributos 'Já aprovado acima' e 'Aprovado' — o que eles significam e como são calculados?
Já trabalhou com Power BI e Apache Superset? Qual acha que é melhor?
Como é que o boosting de gradiente é treinado?
Tarefa em Python: construir sessões de utilizadores por eventos (ruptura > 30 minutos = nova sessão) e calcular agregados diários.
Já utilizou funções de janelamento de ordenação no seu trabalho? Se sim, quais?