Co możesz powiedzieć o API SOAP?
Data Engineer
Jak uruchamialiście DAG-i: według cron, zestawów danych, wyzwalaczy czy zależności?
Jakie kontrole jakości danych przeprowadzono w Data Vault?
Jak podłączali się do OpenMetadata i co z nią robili?
Jak śledzić, w którym uruchomieniu DAG pojawił się konkretny wiersz w Data Vault?
Podaj przykład typowego zadania związane z pisaniem DAG w Airflow.
Czy zarządzałeś Airflow, czy tylko pracowałeś jako programista?
Jak zoptymalizowano tabele i zapytania: partycje, indeksy, logika wyboru?
Czy można używać rozkładu losowego w Greenplum i kiedy jest to odpowiednie?
Opowiedz o sobie: czym się zajmowałeś, jakiego stosu technologicznego używałeś i jaki to był projekt?
Jakie zapytania SQL piszesz: proste kontrole czy skomplikowane skrypty dla hurtowni danych?
Czy było dodatkowe logowanie oprócz logów Airflow?
Kiedy możesz udzielić informacji zwrotnej i czy masz oferty w ręku?
Czy używałeś Bridge i tabel PIT w Data Vault? Podaj przykład i wyjaśnij ich cel.
Jakie dodatkowe encje Data Vault, oprócz hub, link i satellite, były używane: na przykład, same-as links lub transactional links?
Czy S3 był jedynym głównym magazynem, czy używano kilku?
Wymień znane Ci funkcje okienkowe SQL.
Używali jednego kosza S3 czy kilku? Na jakiej zasadzie?
Czy wybudowaliście linię od źródła do konsumenta?
Jaki typ przechowywania ma Parquet: wierszowy czy kolumnowy?