Kuidas töötab Oracle'i päringute optimeerija, millele ta keskendub ja millisesse klassi see kuulub?
Data Engineer
Mis on andmete jagamise eesmärk plokkides HDFS-s?
Kuidas te töötasite Impala'ga?
Kuidas HDFS erineb tavapärastest hajutatud failisüsteemidest?
Kuidas töötab MapReduce, eriti Reduce etapp?
Mis on YARN ja milleks see on vajalik?
Kuidas te töötasite CI/CD-ga?
Kuidas laadisite andmed S3-st Greenplum'i?
Mis on shuffle Sparkis ja miks on oluline seda minimeerida?
Kuidas vaadata päringu täitmise plaani Oracle'is? Mille poolest erineb EXPLAIN PLAN ja EXPLAIN ANALYZE?
Rääkige meile PL/SQL-protseduuride kasutamisest teie töös.
Mis on broadcast join Sparkis?
Kas teil on kogemusi Spark ülesannete optimeerimisel? Kas saaksite anda konkreetse näite?
Kas teil on kunagi olnud vaja kirjutada pakette Oracle'is?
Kas te töötasid inkrementaalsete ja täistekettidega? Kuidas te duplikaateega toime tulite?
Mis vahe on RANK ja DENSE_RANK vahel?
Mis on Hive ja kuidas see erineb traditsioonilistest relatsioonilistest andmebaasidest?
Mis on veergu salvestamise eelis võrreldes ridade salvestamisega?
Kuidas loetakse HDFS-faili, näiteks Parquet — tervikuna või plokkidena?
Kas saaksite rääkida Oracle'i partitsioneerimisest: milleks see kasutatakse ja millised tüübid on olemas?