Hasonlítsa össze a Data Vault megközelítéseket a MCHS-ben és az X5-ben. Milyen előnyöket hoztak az új objektumok (híd, pit-táblák)?
Data Engineer
Milyen típusú elosztásokat használtál? Hogyan választottad ki az elosztási kulcsot?
Milyen gyakran számították ki a kirakatokat? Ez inkrementális vagy teljes számítás volt?
Meséljen a munkatapasztalatáról
Mesélj az adattárolás architektúrájáról: hogyan osztották rétegekre, milyen jellemzői vannak minden rétegnek?
Milyen inkrementális betöltési stratégiákat használtál a dbt-ben?
Milyen Airflow operátorokat használtál? Hogyan léptél kapcsolatba a dbt-vel az Airflow segítségével?
A dbt modell elemzése inkrementális stratégiával: mit csinál a modell, vannak problémák?
Hogyan kerülnek az adatok a jelenlegi munkahelyen lévő tárolóba?
Milyen típusú táblákat használtál a Greenplum-ban? Milyen esetekben használtad a heap-et, és milyen esetekben az Append-Optimized-et?
Milyen jellemzői vannak az XCom használatának az Airflow-ban?
Volt-e esetleg kapcsolat relációs adatbázisokkal?
Mesélj a Greenplum és a ClickHouse indexeiről
Milyen adatforrásokkal tudott dolgozni? Hogyan zajlott az interakció a forrásokkal?
Mesélj a partícionálásról. Milyen érdekes műveleteket kellett végrehajtanod?
Kik voltak az adatok fogyasztói, és hogyan épültek a vitrinek?