Сравнете подходите Data Vault в МЧС и X5. Какви ползи донесоха новите обекти (мост, pit таблици)?
Data Engineer
Колко често се изчисляваха витрините? Беше ли това инкрементално или пълно изчисление?
Разкажете за вашия опит в работата
Разкажи ми за архитектурата на съхранението: как беше разделена на слоеве, какви са характеристиките на всеки слой?
Какви стратегии за инкрементално зареждане в dbt си използвал?
Кои оператори на Airflow използвахте? Как взаимодействахте с dbt чрез Airflow?
Как попадат данните в хранилището на текущото място на работа?
Какви видове дистрибуция сте използвали? Как избрахте ключа за дистрибуция?
Анализ на dbt модел с инкрементална стратегия: какво прави моделът, има ли проблеми?
Какви типове таблици използвахте в Greenplum? В кои случаи се използваше heap, а в кои Append-Optimized?
Какви са характеристиките на използването на XCom в Airflow?
Има ли случаи на взаимодействие с релационни бази данни?
С кои източници на данни успяхте да работите? Как протече взаимодействието с източниците?
Разкажи за индексите в Greenplum и ClickHouse
Разкажи ми за партиционирането. Какви интересни операции си трябвало да извършиш?
Кои бяха потребителите на данни и как се изграждаха витрините?