Confronta gli approcci Data Vault in MChS e X5. Quali vantaggi hanno dato i nuovi oggetti (bridge, tabelle pit)?
Data Engineer
Con quale frequenza venivano calcolate le vetrine? Era un calcolo incrementale o completo?
Parlami della tua esperienza lavorativa
Parlami dell'architettura dello storage: come è stato suddiviso in livelli, quali sono le caratteristiche di ogni livello?
Quali strategie di caricamento incrementale in dbt hai usato?
Quali operatori di Airflow hai usato? Come hai interagito con dbt tramite Airflow?
Come vengono inseriti i dati nel deposito nel tuo attuale luogo di lavoro?
Quali tipi di distribuzione hai utilizzato? Come hai scelto la chiave di distribuzione?
Analisi del modello dbt con strategia incrementale: cosa fa il modello, ci sono problemi?
Quali tipi di tabelle hai usato in Greenplum? In quali casi si usava heap e in quali Append-Optimized?
Quali sono le caratteristiche dell'uso di XCom in Airflow?
Ci sono stati casi di interazione con database relazionali?
Parla degli indici in Greenplum e ClickHouse
Con quali fonti di dati hai lavorato? Come è avvenuta esattamente l'interazione con le fonti?
Parlami di partizionamento. Quali operazioni interessanti hai dovuto fare?
Chi erano i consumatori di dati e come venivano costruite le vetrine?