¿Qué puedes contarme sobre SOAP API?
Data Engineer
¿Cómo ejecutaron los DAGs: por cron, conjuntos de datos, disparadores o dependencias?
¿Qué verificaciones de calidad de datos se realizaron en Data Vault?
¿Cómo se conectaron a OpenMetadata y qué hicieron con ella?
¿Cómo rastrear en qué ejecución del DAG apareció una línea específica en Data Vault?
Proporcione un ejemplo de una tarea típica de escritura de DAG en Airflow.
¿Administró Airflow o solo trabajó como desarrollador?
¿Cómo optimizaron las tablas y las consultas: particiones, índices, lógica de selección?
¿Se puede usar distribución aleatoria en Greenplum y cuándo es apropiado?
Cuéntame sobre ti: ¿en qué has trabajado, qué pila de tecnologías has utilizado y qué tipo de proyecto era?
¿Qué consultas SQL escribes: verificaciones simples o scripts complejos para vitrinas?
¿Se realizó un registro adicional además de los registros de Airflow?
¿Cuándo puedes dar retroalimentación y tienes ofertas en mano?
¿Utilizaron Bridge y tablas PIT en Data Vault? Da un ejemplo y explica su propósito.
¿Qué entidades adicionales de Data Vault, además de hub, link y satellite, se utilizaron: por ejemplo, enlaces same-as o enlaces transaccionales?
¿S3 fue el único almacenamiento principal o se utilizaron varios?
Enumere las funciones de ventana SQL que conoce.
¿Usaron un solo bucket de S3 o varios? ¿Según qué principio?
¿Habían establecido la línea de origen hasta el consumidor?
¿Qué tipo de almacenamiento tiene Parquet: de filas o de columnas?