¿Has trabajado con Kafka?
Data Engineer
Cuéntame en general sobre tu experiencia y qué has estudiado.
¿Por qué decidiste abandonar tu proyecto actual? ¿Qué no te satisface allí?
¿Por qué dejas tu trabajo actual?
¿En qué se diferencia Hive de Impala?
¿Has tenido tareas ad-hoc a pesar de tener una especificación clara, y cómo te sientes respecto a las solicitudes ad-hoc y los cambios de prioridades?
¿Cuáles son tus expectativas de un nuevo proyecto?
¿Has construido paneles y trabajado con herramientas de visualización de datos (herramientas de BI)?
¿Estás familiarizado con los cubos OLAP? Cuando trabajamos con datos multidimensionales, similares a una tabla dinámica en Excel, pero para una interacción más rápida con grandes volúmenes de datos.
¿Existen funciones y capacidades en Greenplum que no estén en MySQL convencional y otros dialectos?
¿Qué hacías normalmente en PostgreSQL? ¿Creaste índices y qué más hiciste dentro de la base de datos?
Cuéntenos cómo usó Hadoop/HDFS/Hive.
¿Cuál es la diferencia entre VACUUM y VACUUM FULL en PostgreSQL?
Tenemos un ORDER BY por cantidad de pedidos, y hay dos pedidos con 5, otros dos pedidos con 3. ¿Cómo se comportarán RANK() y DENSE_RANK()?
¿En qué orden se realizan las operaciones principales en SQL: SELECT, FROM, etc.?
¿En qué casos es más adecuado Nested Loop Join?
¿Cómo se implementó el operador personalizado de Airflow: a través de BashOperator?
¿Estás actualmente en entrevistas? ¿Tienes ofertas o estás en etapas finales, especialmente en bancos?
¿Has enfrentado conflictos dentro del equipo o con un gerente? ¿Cómo lo manejaste? Da ejemplos.
Cuéntenos sobre trabajos de Spark: qué escribió, qué abstracciones y operaciones utilizó?