Porównaj podejścia Data Vault w MChS i X5. Jakie korzyści przyniosły nowe obiekty (bridge, tabele pit)?
Data Engineer
Jak często obliczano witryny? Czy był to obliczenie inkrementalne czy pełne?
Opowiedz o architekturze magazynu: jak był podzielony na warstwy, jakie są cechy każdej warstwy?
Opowiedz o swoim doświadczeniu zawodowym
Jakie strategie ładowania przyrostowego w dbt stosowałeś?
Jakimi rodzajami dystrybucji się posługiwałeś? Jak wybierałeś klucz dystrybucji?
Jakimi operatorami Airflow się posługiwałeś? Jak współpracowałeś z dbt przez Airflow?
Jak dane trafiają do magazynu w Twoim obecnym miejscu pracy?
Analiza modelu dbt z strategią inkrementalną: co robi model, czy są problemy?
Jakimi typami tabel w Greenplum się posługiwałeś? W jakich przypadkach używałeś heap, a w jakich Append-Optimized?
Czy były przypadki interakcji z relacyjnymi bazami danych?
Jakie są cechy korzystania z XCom w Airflow?
Opowiedz o indeksach w Greenplum i ClickHouse
Z jakimi źródłami danych udało się pracować? Jak dokładnie przebiegała interakcja ze źródłami?
Opowiedz o partycjonowaniu. Jakie ciekawe operacje musiałeś wykonać?
Kim byli odbiorcy danych i jak budowano witryny?