Mis à part l'API, quels autres moyens et protocoles avez-vous utilisés pour travailler avec les sources de données?
Data Engineer
As-tu écrit des processus d'ingestion pour OpenMetadata qui analysent les sources?
Quel ordre ou type de compression est utilisé dans Parquet?
Comment travaillaient-ils avec 1C : récupéraient-ils les données directement de la base de données, via un bus ou d'une autre manière ?
Que se passait-il lorsque la restriction de qualité des données était déclenchée : alerte, panne, redémarrage ?
Pourquoi avoir utilisé Parquet plutôt que ORC?
À quoi servent les "dossiers"/préfixes dans S3 en plus de la commodité?
Quels champs techniques ont été utilisés dans les satellites, links et hubs Data Vault?
Avez-vous stocké les résultats des vues tabulaires en Parquet ou autrement dans S3?
Avez-vous travaillé avec FTP pour obtenir des fichiers ou des données via le portail?
Avez-vous configuré des balises dans S3 sur des buckets ou des objets?
Comment avez-vous déterminé que l'enregistrement existe déjà et qu'il n'est pas nécessaire de le réenregistrer?
Avec quels formats de fichiers avez-vous travaillé?