¿Has utilizado XCom en Airflow?
Data Engineer
¿Puede explicar el particionamiento en Oracle: para qué se utiliza y qué tipos existen?
¿Cuándo se pueden usar los formatos de la familia CSV?
¿Se puede ver el esquema de la tabla antes de ejecutar la consulta en Hive?
¿Qué son las vistas (VIEW) y las vistas materializadas (MATERIALIZED VIEW) en Oracle? ¿Cómo se actualizan los datos en una vista materializada?
¿Siempre coincide el plan de ejecución de EXPLAIN con lo que realmente se ejecuta?
¿Qué son las operaciones perezosas en Spark y para qué sirven?
Cuéntame sobre tu proyecto anterior, ¿cuáles eran tus responsabilidades?
¿Qué otros formatos de archivo, además de Parquet, funcionan bien con Hadoop y Hive?
¿Cómo se corresponde su experiencia con las responsabilidades del puesto: acompañamiento y análisis de procesos de carga, monitoreo y detección de anomalías, pruebas e implementación de mejoras en producción, soporte de segunda línea, revisión de documentación técnica?
¿Ha tenido que trabajar con Oracle Data Integrator (ODI)?
¿Cómo conocer el plan real de ejecución de una consulta en Oracle?
¿Cuáles son las ventajas y desventajas de los sistemas de bases de datos distribuidos?
¿Puedes recordar tu experiencia en optimización de consultas? ¿Cómo actuaste, analizaste?
¿En qué se diferencia la multitarea de la multiprocesamiento? ¿Para qué tareas usar hilos y para cuáles procesos?
Hubo una consulta analítica lenta en Hive. ¿Cómo entender qué le sucedió y cómo arreglarla?
¿Para qué se separan las vistas (VIEW) y las tablas? ¿Para qué sirven las vistas?
¿Cuál fue su arquitectura en el proyecto? ¿DWH u otra cosa?
¿Has trabajado con carga por lotes o streaming?
¿Has trabajado con funciones de ventana? ¿Qué tipos de funciones de ventana conoces?