Como funciona o otimizador de consultas no Oracle, o que ele observa e a que classe pertence?
Data Engineer
Qual é o propósito de dividir os dados em blocos no HDFS?
Como trabalhavam com Impala?
Em que HDFS difere dos sistemas de ficheiros distribuídos comuns?
Como funciona o MapReduce, em particular a fase Reduce?
O que é o YARN e para que serve?
Como trabalharam com CI/CD?
Como carregou os dados do S3 para o Greenplum?
O que é shuffle no Spark e por que é importante minimizá-lo?
Como visualizar o plano de execução de uma consulta no Oracle? Em que o EXPLAIN PLAN difere do EXPLAIN ANALYZE?
Fale-nos sobre o uso de procedimentos PL/SQL no seu trabalho.
O que é uma junção de transmissão no Spark?
Tem experiência em otimização de tarefas Spark? Pode dar um exemplo concreto?
Já teve que escrever pacotes no Oracle?
Já trabalhou com cargas incrementais e completas? Como lidou com os duplicados?
Como é que um ficheiro do HDFS, por exemplo Parquet, é lido — na íntegra ou por blocos?
Qual é a diferença entre RANK e DENSE_RANK?
Qual é a vantagem do armazenamento em coluna em relação ao armazenamento em linha?
O que é o Hive e como se diferencia das bases de dados relacionais tradicionais?
Fale sobre particionamento no Oracle: para que é usado e quais tipos existem?