Oracle-догу суроо оптимизатору кантип иштейт, эмне карайт жана кайсы класска таандык?
Data Engineer
HDFSте маалыматтарды блокторго бөлүүнүн мааниси эмнеде?
Impala менен кантип иштедиңиз?
HDFS башка бөлүштүрүлгөн файл системдеринен эмнеге айырмаланат?
MapReduce кандай иштейт, өзгөчө Reduce этабы?
YARN деген эмне жана ал эмне үчүн керек?
CI/CD менен кандай иштедиңиз?
S3'төн Greenplumка маалыматтарды кантип жүктөдүңүз?
Sparkтеги shuffle эмне жана аны минималдаштыруу эмне үчүн маанилүү?
Oracleда сурак аткаруу планыны кантип көрө алам? EXPLAIN PLAN менен EXPLAIN ANALYZE кандай айырмаланат?
Ишиңизде PL/SQL ыкмаларын колдонуу жөнүндө айтыңыз.
Sparkтеги broadcast join деген эмне?
Oracleда пакеттерди жазуу керек болдуңузбу?
Инкрементал жана толук жүктөөлөр менен иштедиңби? Көбөйтүүлөр менен кантип күрөштүң?
Spark тапшырмаларын оптималдаштыру боюнча тажрыйбаңыз барбы? Так илинак мисал келтире аласызбы?
HDFS-деги файлды, мисалы Parquet, кантип окуйт — толугу мененби же блокторго бөлүнгөнбү?
RANK менен DENSE_RANKтин айырмасы неде?
Ба колонка түрүндөгү сактоо менен саптык сактоо арасындагы айырма эмне?
Hive-деги бөлүү кандай иштейт жана ал файлдык системада кандайча физикалык түрдө көрсөтүлгөн?
Oracle-догу көрүнүштөр (VIEW) жана материалдаштырылган көрүнүштөр (MATERIALIZED VIEW) эмнелер? Материалдаштырылган көрүнүштөгү маалыматтар кандайча жаңыртылат?