HDFS-dən fayl necə oxunur, məsələn Parquet — tam və ya bloklar şəklində?
Data Engineer
Airflow-da XCom istifadə etmisinizmi?
CSV format ailəsindən nə vaxt istifadə etmək olar?
EXPLAIN-in icra planı həmişə gerçəkdə icra olunanla uyğun gəlirmi?
Hive-də sorğu icra etməzdən əvvəl cədvəl sxeməsini görə bilərikmi?
Niyə görünüşlər (VIEW) və cədvəllər ayrılır? Görünüşlər nə üçün lazımdır?
Oracle'da sorğunun real icra planını necə öyrənmək olar?
Parquet-dən başqa hansı digər fayl formatları Hadoop və Hive ilə yaxşı işləyir?
Oracle'da baxışlar (VIEW) və materializasiyalaşdırılmış baxışlar (MATERIALIZED VIEW) nədir? Materializasiyalaşdırılmış baxışdakı məlumatlar necə yenilənir?
Spark-də tənbəl əməliyyatlar nədir və onlar nə üçün lazımdır?
Keçmiş layihəniz haqqında danışın, vəzifələriniz nələr idi?
Oracle Data Integrator (ODI) ilə işləmək məcburiyyətində qaldınızmı?
Təcrübəniz vəzifənin öhdəliklərinə necə uyğundur: yükləmə proseslərinin müşahidəsi və analizi, anomaliyaların monitorinqi və aşkarlanması, test və təkmilləşdirmələrin istehsalda quraşdırılması, ikinci xətt dəstəyi, texniki sənədlərin yoxlanması?
Paylanmış verilənlər bazası sistemlərinin üstünlükləri və çatışmazlıqları nələrdir?
Hive-də yavaş analitik sorğu baş verdi. Onun nə baş verdiyini necə başa düşmək və necə təmir etmək olar?
Çox iplikli işləmə ilə çox prosessli işləmə arasındakı fərq nədir? Hansı tapşırıqlar üçün ipliklər, hansı tapşırıqlar üçün proseslər istifadə olunur?
Batch yükləmə və ya axın ilə işlədinizmi?
Sorğuların optimallaşdırılması təcrübənizi xatırlaya bilərsinizmi? Necə hərəkət etdiniz, analiz etdiniz?
Layihədə sizin memarlığınız nə idi? DWH və ya başqa bir şey?
Pəncərə funksiyaları ilə işlədinizmi? Hansı pəncərə funksiyaları növlərini bilirsiniz?