Ako funguje optimalizátor dopytov v Oracle, na čo sa pozerá a ku ktorému triede patrí?
Data Engineer
Aký je zmysel rozdeľovania dát na bloky v HDFS?
Ako ste pracovali s Impala?
Čo sa líši od HDFS od bežných distribuovaných súborových systémov?
Ako funguje MapReduce, najmä fáza Reduce?
Čo je YARN a na čo slúži?
Ako ste pracovali s CI/CD?
Ako ste načítali údaje zo S3 do Greenplum?
Čo je shuffle v Spark a prečo je dôležité ho minimalizovať?
Ako si pozrieť plán vykonávania dotazu v Oracle? Čo sa líši od EXPLAIN PLAN do EXPLAIN ANALYZE?
Povedzte nám o používaní PL/SQL procedúr vo vašej práci.
Čo je broadcast join v Spark?
Máte skúsenosti s optimalizáciou úloh Spark? Môžete uviesť konkrétny príklad?
Museli ste niekedy písať balíky v Oracle?
Pracoval si s inkrementálnym a úplným načítaním? Ako si sa vysporiadal s duplikátmi?
Ako sa číta súbor z HDFS, napríklad Parquet — celý alebo po blokoch?
Čím sa líši RANK od DENSE_RANK?
Aký je rozdiel medzi stĺpcovým a riadkovým ukladaním?
Môžete vysvetliť partícionovanie v Oracle: na čo sa používa a aké druhy existujú?
Ako funguje partíciovanie v Hive a ako je fyzicky zobrazené v súborovom systéme?