Oracle'da so'rov optimizatori qanday ishlaydi, nima ko'radi va qaysi sinfga tegishli?
Data Engineer
HDFSda ma'lumotlarni bloklarga bo'lishning maqsadi nima?
Impala bilan qanday ishladingiz?
HDFS oddiy tarqatilgan fayl tizimlaridan qanday farq qiladi?
MapReduce qanday ishlaydi, ayniqsa Reduce bosqichi?
YARN nima va u nima uchun kerak?
CI/CD bilan qanday ishladingiz?
S3-dan Greenplum-ga ma'lumotlarni qanday yukladingiz?
Sparkda shuffle nima va uni minimallashtirish muhimmi?
Oracle'da so'rov bajarish rejasini qanday ko'rish mumkin? EXPLAIN PLAN va EXPLAIN ANALYZE qanday farq qiladi?
Ishingizda PL/SQL protseduralaridan foydalanish haqida gapiring.
Spark vazifalarini optimallashtirish bo'yicha tajribangiz bormi? Aniq misol keltira olasizmi?
Sparkda broadcast join nima?
Siz inkremental va to'liq yuklamalar bilan ishladingizmi? Takrorlarni qanday boshqardingiz?
Oracle'da paketlar yozish majburiyati bo'ldimi?
Hive nima, u qanday farq qiladi an'anaviy relational ma'lumotlar bazalaridan?
RANK va DENSE_RANK qanday farq qiladi?
Ustun turidagi saqlashning qator turidagi saqlashga nisbatan afzalligi nima?
HDFS fayli, masalan Parquet, qanday o'qiladi — to'liqmi yoki bloklar bo'libmi?
CSV formatlari oilasidan qachon foydalanish mumkin?