Po jakich polach dystrybuowałeś dane w Greenplum?
Data Engineer
Czy pracowałeś z Kafka?
Opowiedz ogólnie o swoim doświadczeniu i czego się uczyłeś.
Czym różni się Hive od Impala?
Dlaczego zdecydowałeś się opuścić swój obecny projekt? Co tam ci się nie podoba?
Czy miałeś zadania ad-hoc mimo jasnego briefu, i jak podchodzisz do zapytań ad-hoc i zmian priorytetów?
Czy budowałeś pulpity nawigacyjne i pracowałeś z narzędziami do wizualizacji danych (narzędzia BI)?
Jakie są twoje oczekiwania wobec nowego projektu?
Czy miałeś konflikty w zespole lub z kierownikiem? Jak sobie z tym poradziłeś? Podaj przykłady.
Czy znasz kostki OLAP? Gdy pracujemy z danymi wielowymiarowymi, podobnymi do tabeli przestawnej w Excelu, ale dla szybszej interakcji z dużymi ilościami danych.
Czy w Greenplum są funkcje i możliwości, których nie ma zwykły MySQL i inne dialekty?
Co zwykle robiłeś w PostgreSQL? Tworzyłeś indeksy i co jeszcze robiłeś w bazie danych?
Jaka jest różnica między VACUUM a VACUUM FULL w PostgreSQL?
Opowiedz nam, jak korzystałeś z Hadoop/HDFS/Hive.
Mamy ORDER BY według liczby zamówień, i mamy dwa zamówienia po 5, jeszcze dwa po 3. Jak zachowają się RANK() i DENSE_RANK()?
Jak został zaimplementowany niestandardowy operator Airflow: przez BashOperator?
W jakiej kolejności wykonywane są główne operacje w SQL: SELECT, FROM itp.?
W jakich przypadkach Nested Loop Join jest najbardziej odpowiedni?
Czy obecnie bierzesz udział w rozmowach kwalifikacyjnych? Masz oferty lub jesteś na ostatnich etapach, szczególnie w bankach?
Dlaczego MergeTree jest potrzebny w ClickHouse?