Já trabalhou com Kafka?
Data Engineer
Fala-me um pouco sobre a tua experiência e o que estudaste.
Como o Hive difere do Impala?
Por que decidiste sair do teu projeto atual? O que lá não te satisfaz?
Por que está a deixar o seu emprego atual?
Tiveste tarefas ad-hoc mesmo com um briefing claro, e como te sentes em relação a pedidos ad-hoc e mudanças de prioridades?
Quais são as suas expectativas de um novo projeto?
Já construiu painéis e trabalhou com ferramentas de visualização de dados (ferramentas de BI)?
Conhece os cubos OLAP? Quando trabalhamos com dados multidimensionais, semelhantes a uma tabela dinâmica no Excel, mas para uma interação mais rápida com grandes volumes de dados.
Existem funções e capacidades no Greenplum que não estão no MySQL comum e outros dialetos?
O que costumava fazer no PostgreSQL? Criou índices e o que mais fez dentro do banco de dados?
Qual é a diferença entre VACUUM e VACUUM FULL no PostgreSQL?
Conte-nos como usou Hadoop/HDFS/Hive.
Temos um ORDER BY por quantidade de pedidos, e há dois pedidos com 5, mais dois pedidos com 3. Como se comportarão RANK() e DENSE_RANK() ?
Como foi implementado o operador personalizado do Airflow: através do BashOperator?
Em que casos o Nested Loop Join é mais adequado?
Qual é a ordem das operações principais em SQL: SELECT, FROM, etc.?
Está atualmente a fazer entrevistas? Tem ofertas ou está nas fases finais, especialmente em bancos?
Já enfrentaste conflitos dentro da equipa ou com um gestor? Como lidaste com isso? Forneça exemplos.
Por que o MergeTree é necessário no ClickHouse?