Oracle-да query optimizer қалай жұмыс істейді, ол не нәрсеге қарайды және ол қандай сыныпқа жатады?
Data Engineer
HDFS-те деректерді блоктарға бөлу мақсаты неде?
Impala-мен қалай жұмыс істедіңіз?
HDFS кәдімгі таралған файл жүйелерінен қалай ерекшеленеді?
MapReduce қалай жұмыс істейді, әсіресе Reduce кезеңі?
YARN дегеніміз не және ол не үшін қажет?
CI/CD-пен қалай жұмыс істедіңіз?
Сіз S3-тен деректерді Greenplum-қа қалай жүктедіңіз?
Spark-те shuffle деген не және оны азайту неге маңызды?
Oracle-да сұраудың орындалу жоспарын қалай көруге болады? EXPLAIN PLAN мен EXPLAIN ANALYZE қалай ерекшеленеді?
Жұмысыңызда PL/SQL процедураларын пайдалану тәжірибеңіз туралы айтыңыз.
Spark-те broadcast join дегеніміз не?
Spark тапсырмаларын оңтайландыру тәжірибеңіз бар ма? Нақты мысал келтіре аласыз ба?
Инкременттік және толық жүктеумен жұмыс істедіңіз бе? Көші-қондармен қалай күрестіңіз?
Oracle-мен жұмыс істедіңіз бе?
Hive дегеніміз не және ол дәстүрлі реляциялық дерекқорлардан қалай ерекшеленеді?
RANK пен DENSE_RANK арасындағы айырмашылық неде?
HDFS-тен, мысалы Parquet файлын, қалай оқиды — толық немесе блоктар бойынша?
Hive-да бөлу қалай жұмыс істейді және ол файл жүйесінде қалай физикалық түрде көрсетіледі?
Бағандық сақтау түрінің жолдық сақтау түріне қарағанда артықшылығы неде?