¿Qué orden o tipo de compresión se utiliza en Parquet?
Data Engineer
¿Además de la API, qué otros métodos y protocolos utilizó para trabajar con las fuentes de datos?
¿Cómo trabajaban con 1C: extraían datos directamente de la base de datos, a través de un bus o de otra manera?
¿Escribiste procesos de ingestión en OpenMetadata que escanean las fuentes?
¿Qué ocurría cuando se activaba la restricción de calidad de datos: una alerta, una caída, un reinicio?
¿Por qué utilizaron Parquet en lugar de ORC?
¿Para qué sirven las "carpetas"/prefijos en S3 además de la conveniencia?
¿Qué campos técnicos se utilizaron en satellites, links y hubs Data Vault?
¿Ha trabajado con FTP para obtener archivos o datos a través del portal?
¿Almacenaron en S3 los resultados de las vistas tabulares en Parquet u otro formato?
¿ Configuraron etiquetas en S3 en los buckets o en los objetos?
¿Cómo determinaron que la entrada ya existe y no es necesario volver a grabarla?
¿Con qué formatos de archivos trabajaste?