Porovnejte přístupy Data Vault v MChS a X5. Jaké přínosy přinesly nové objekty (bridge, pit tabulky)?
Data Engineer
Jak často byly počítány vitríny? Byla to inkrementální nebo úplná kalkulace?
Pověz mi o architektuře úložiště: jak bylo rozděleno na vrstvy, jaké jsou vlastnosti každé vrstvy?
Povězte mi o svých pracovních zkušenostech
Jaké strategie inkrementálního načítání jsi používal v dbt?
Jaké operátory Airflow jste používali? Jak jste komunikovali s dbt přes Airflow?
Jak se data dostávají do úložiště na vašem současném pracovišti?
Jakými druhy distribuce jste používal? Jak jste vybíral klíč distribuce?
Analýza dbt modelu s inkrementální strategií: co model dělá, jsou s tím problémy?
Jaké typy tabulek jste v Greenplum používal? V jakých případech se používal heap a v jakých Append-Optimized?
Byly případy interakce s relačními databázemi?
Jaké jsou vlastnosti používání XCom v Airflow?
Povězte o indexech v Greenplum a ClickHouse
S jakými zdroji dat jste pracovali? Jak přesně probíhala interakce se zdroji?
Pověz mi o rozdělení na části. Jaké zajímavé operace jsi musel provést?
Kdo byli spotřebitelé dat a jak byly stavěny vitríny?