HDFS-деги файлды, мисалы Parquet, кантип окуйт — толугу мененби же блокторго бөлүнгөнбү?
Data Engineer
Airflowдеги XComди колдондуңбу?
CSV форматтары үй-бүлөсүн качан колдонсо болот?
EXPLAINдин аткаруу планы ар дайым ишке ашырылып жаткан менен шайкеш келе береби?
Hive-деги суроолорду ишке ашырганга чейин таблицанын схемасын көрө аласызбы?
Көрүнүштөр (VIEW) жана таблицалар эмне үчүн бөлүнөт? Көрүнүштөр эмне үчүн керек?
Oracleда суроо-талаптын чындык ишке ашыруу планы кандай билинсе болот?
Parquetтен башка кайсы файл форматтары Hadoop жана Hive менен жакшы иштейт?
Oracle-догу көрүнүштөр (VIEW) жана материалдаштырылган көрүнүштөр (MATERIALIZED VIEW) эмнелер? Материалдаштырылган көрүнүштөгү маалыматтар кандайча жаңыртылат?
Sparkтеги жайгашкан операциялар деген эмне жана алар эмне үчүн керек?
Өткөн долбооруң жөнүндө айтып бер, кандай милдеттериң болчу?
Oracle Data Integrator (ODI) менен иштөө керек болдуңузбу?
Кандайчаңыз, сиздин тажрыйбаңыз жумуш ордуунун милдеттерине канчалык ылайыктуу: жүктөө процесстерин көзөмөлдөө жана талдоо, аномалияларды мониторинг жана аныктоо, тестирлөө жана өндіріске жакшыртууларды орнотуу, экинчи катар колдоо, техникалык документацияны текшерүү?
Бөлүштүрүлгөн маалыматтар базаларынын системаларынын артыкчылыктары жана кемчиликтери эмне?
Hive-де жайылма аналитикалык суроо-талап болду. Анын эмне болгонун кантип түшүнүп, аны кантип оңдоого болот?
Көптөгөндүк менен көп процессорлуулук кандай айырмаланат? Канча тапшырма үчүн жиптерди, канча тапшырма үчүн процесстерди колдонуу керек?
Батч жүктөө же стриминг менен иштедиңби?
Суроолорду оптималдаштыруу боюнча тажрыйбаңды эстей аласызбы? Кантип аракет кылдың, анализ кылдың?
Жобадагы архитектураңыз кандай болду? DWH же башка нерсе?
Терезе функциялары менен иштедиңби? Кантип терезе функцияларынын түрлөрүн билесиң?