Cosa puoi dirmi sull'API SOAP?
Data Engineer
Come avete avviato i DAG: tramite cron, dataset, trigger o dipendenze?
Quali controlli di qualità dei dati sono stati eseguiti in Data Vault?
Come ti sei connesso a OpenMetadata e cosa hai fatto con essa?
Come tracciare in quale esecuzione del DAG è apparsa una riga specifica nel Data Vault?
Fornisci un esempio di compito tipico di scrittura di DAG in Airflow.
Hai amministrato Airflow o hai lavorato solo come sviluppatore?
Come hanno ottimizzato le tabelle e le query: partizioni, indici, logica di selezione?
Quali query SQL scrivi: controlli semplici o script complessi per i data warehouse?
Hai effettuato un logging aggiuntivo oltre ai log di Airflow?
Parlami di te: cosa hai fatto, quale stack hai usato e di che tipo era il progetto?
Quando puoi dare feedback e hai offerte in mano?
Hai usato Bridge e tabelle PIT in Data Vault? Fornisci un esempio e spiega lo scopo.
È possibile utilizzare la distribuzione casuale in Greenplum e quando è appropriato?
Quali entità aggiuntive di Data Vault, oltre a hub, link e satellite, sono state utilizzate: ad esempio, link same-as o link transazionali?
S3 era l'unico storage principale o ne sono stati usati diversi?
Elenca le funzioni di finestra SQL che conosci.
Hanno usato un solo bucket S3 o più? Secondo quale principio?
Avete stabilito la linea dalla fonte al consumatore?
Quale tipo di archiviazione ha Parquet: riga o colonna?