Oracle'da sorğu optimizatoru necə işləyir, nəyə baxır və hansı sinfə aiddir?
Data Engineer
HDFS-də məlumatların bloklara bölünməsinin məqsədi nədir?
Impala ilə necə işləyirdiniz?
HDFS ümumi paylanmış fayl sistemlərindən necə fərqlənir?
MapReduce necə işləyir, xüsusən də Reduce mərhələsi?
YARN nədir və nə üçün lazımdır?
CI/CD ilə necə işlədiniz?
S3-dən Greenplum-a məlumatları necə yüklədiniz?
Spark-də shuffle nədir və niyə onu minimallaşdırmaq vacibdir?
Oracle'da sorğu icra planını necə görmək olar? EXPLAIN PLAN ilə EXPLAIN ANALYZE arasındakı fərq nədir?
İşinizdə PL/SQL prosedurlarının istifadəsi haqqında danışın.
Spark tapşırıqlarının optimallaşdırılması təcrübəniz varmı? Konkret nümunə göstərə bilərsinizmi?
Spark-də broadcast join nədir?
İnkrement və tam yükləmə ilə işlədinizmi? Təkrarlamalarla necə mübarizə apardınız?
Oracle-da paketlər yazmaq məcburiyyətində qalmısınızmı?
Hive nədir və ənənəvi əlaqəli verilənlər bazalarından necə fərqlənir?
RANK və DENSE_RANK arasındakı fərq nədir?
HDFS-dən fayl necə oxunur, məsələn Parquet — tam və ya bloklar şəklində?
Sütun tipli yaddaşın sətir tipli yaddaşa nisbətən üstünlüyü nədir?
CSV format ailəsindən nə vaxt istifadə etmək olar?