Neben der API, mit welchen anderen Methoden und Protokollen haben Sie mit Datenquellen gearbeitet?
Data Engineer
Hast du Ingestion-Prozesse für OpenMetadata geschrieben, die Quellen scannen?
Welche Reihenfolge oder Art der Komprimierung wird in Parquet verwendet?
Wie arbeiteten sie mit 1C: Holten sie Daten direkt aus der Datenbank, über eine Bus-Verbindung oder auf andere Weise?
Was passierte, wenn die Datenqualitätsbeschränkung ausgelöst wurde: Alarm, Ausfall, Neustart?
Warum wurde Parquet anstelle von ORC verwendet?
Wozu dienen "Ordner"/Präfixe in S3 neben der Bequemlichkeit?
Welche technischen Felder wurden in Satelliten, Links und Hubs Data Vault verwendet?
Haben Sie die Ergebnisse tabellarischer Ansichten in Parquet oder anders in S3 gespeichert?
Haben Sie mit FTP gearbeitet, um Dateien oder Daten über das Portal zu erhalten?
Haben Sie Tags in S3 auf Buckets oder Objekten eingerichtet?
Wie haben Sie festgestellt, dass der Eintrag bereits existiert und nicht erneut gespeichert werden muss?
Mit welchen Dateiformaten haben Sie gearbeitet?