¿Cómo funciona el optimizador de consultas en Oracle, qué observa y a qué clase pertenece?
Data Engineer
¿Cuál es el propósito de dividir los datos en bloques en HDFS?
¿Cómo trabajaron con Impala?
¿En qué se diferencia HDFS de los sistemas de archivos distribuidos tradicionales?
¿Cómo funciona MapReduce, en particular la etapa Reduce?
¿Qué es YARN y para qué sirve?
¿Cómo trabajaron con CI/CD?
¿Cómo cargó los datos desde S3 en Greenplum?
¿Qué es shuffle en Spark y por qué es importante minimizarlo?
¿Cómo ver el plan de ejecución de una consulta en Oracle? ¿En qué se diferencia EXPLAIN PLAN de EXPLAIN ANALYZE?
Cuéntenos sobre el uso de procedimientos PL/SQL en su trabajo.
¿Qué es una unión de transmisión en Spark?
¿Tiene experiencia en la optimización de tareas Spark? ¿Puede dar un ejemplo concreto?
¿Alguna vez has tenido que escribir paquetes en Oracle?
¿Has trabajado con cargas incrementales y completas? ¿Cómo manejaste los duplicados?
¿Cómo se lee un archivo de HDFS, por ejemplo Parquet: de forma completa o por bloques?
¿Cuál es la ventaja del almacenamiento en columna frente al almacenamiento en fila?
¿En qué se diferencia RANK de DENSE_RANK?
¿Puede explicar el particionamiento en Oracle: para qué se utiliza y qué tipos existen?
¿Cómo funciona la partición en Hive y cómo se representa físicamente en el sistema de archivos?