Comparez les approches Data Vault dans MChS et X5. Quels avantages ont apporté les nouveaux objets (pont, tables pit) ?
Data Engineer
À quelle fréquence les vitrines étaient-elles calculées ? S'agissait-il d'un calcul incrémental ou complet ?
Quels types de distribution avez-vous utilisés ? Comment avez-vous choisi la clé de distribution ?
Parlez-moi de l'architecture du stockage : comment était-elle divisée en couches, quelles sont les caractéristiques de chaque couche ?
Parlez-moi de votre expérience professionnelle
Quelles stratégies de chargement incrémental dans dbt avez-vous utilisées?
Quels opérateurs Airflow avez-vous utilisés ? Comment avez-vous interagi avec dbt via Airflow ?
Analyse du modèle dbt avec stratégie incrémentielle : que fait le modèle, y a-t-il des problèmes?
Comment les données sont-elles stockées dans votre lieu de travail actuel?
Quels types de tables avez-vous utilisés dans Greenplum ? Dans quels cas utilisiez-vous heap, et dans quels cas Append-Optimized ?
Y a-t-il eu des cas d'interaction avec des bases de données relationnelles?
Quelles sont les caractéristiques de l'utilisation de XCom dans Airflow?
Parlez des index dans Greenplum et ClickHouse
Avec quelles sources de données avez-vous travaillé ? Comment s'est déroulée l'interaction avec les sources ?
Parle-moi du partitionnement. Quelles opérations intéressantes as-tu dû effectuer?
Qui étaient les consommateurs de données et comment étaient construites les vitrines?