Was kannst du über SOAP API erzählen?
Data Engineer
Wie haben Sie die DAGs gestartet: per Cron, Datensätze, Trigger oder Abhängigkeiten?
Welche Datenqualitätsprüfungen wurden im Data Vault durchgeführt?
Wie haben sie sich mit OpenMetadata verbunden und was haben sie damit gemacht?
Wie verfolgt man, in welchem DAG-Run eine bestimmte Zeile im Data Vault erschienen ist?
Geben Sie ein Beispiel für eine typische Aufgabe beim Schreiben eines DAG in Airflow.
Haben Sie Airflow verwaltet oder nur als Entwickler gearbeitet?
Wie wurden Tabellen und Abfragen optimiert: Partitionen, Indizes, Auswahllogik?
Kann man in Greenplum eine zufällige Verteilung verwenden und wann ist das angemessen?
Erzähle mir von dir: Was hast du gemacht, welchen Technologie-Stack hast du verwendet und um was für ein Projekt handelte es sich?
Welche SQL-Abfragen schreibst du: einfache Prüfungen oder komplexe Skripte für Data Warehouses?
Wurde zusätzliches Logging durchgeführt, außer den Airflow-Protokollen?
Wann kannst du Feedback geben und hast du Angebote in der Hand?
Haben Sie Bridge und PIT-Tabellen im Data Vault verwendet? Geben Sie ein Beispiel und erklären Sie den Zweck.
Welche zusätzlichen Entitäten des Data Vault, neben Hub, Link und Satellite, wurden verwendet: zum Beispiel Same-as-Links oder Transaktions-Links?
War S3 der einzige primäre Speicher oder wurden mehrere verwendet?
Nennen Sie die Ihnen bekannten SQL-Fensterfunktionen.
Verwendeten sie nur einen S3-Bucket oder mehrere? Nach welchem Prinzip?
Haben Sie die Linienführung vom Ursprung bis zum Verbraucher aufgebaut?
Welchen Speichertyp hat Parquet: Zeile oder Spalte?