Kako radi query optimizer u Oracle, na šta gleda i kojem klasu pripada?
Data Engineer
Koji je smisao deljenja podataka na blokove u HDFS?
Kako ste radili sa Impala?
Čime se HDFS razlikuje od običajnih distribuiranih datotečnih sistema?
Kako funkcioniše MapReduce, posebno faza Reduce?
Šta je YARN i čemu služi?
Kako ste radili sa CI/CD?
Kako ste učitali podatke iz S3 u Greenplum?
Šta je shuffle u Spark-u i zašto je važno da ga minimiziramo?
Kako pogledati plan izvršenja upita u Oracle? Čime se razlikuje EXPLAIN PLAN od EXPLAIN ANALYZE?
Ispričajte nam o korišćenju PL/SQL procedura u vašem radu.
Имате ли искуства у оптимизацији Spark задатака? Можете ли дати конкретан пример?
Šta je broadcast join u Spark-u?
Да ли сте икада морали да пишете пакете у Oracle-у?
Da li ste radili sa inkrementalnim i punim učitavanjem? Kako ste se borili sa duplikatima?
Kako se čita fajl iz HDFS-a, na primer Parquet — u celosti ili po blokovima?
Koja je prednost skladištenja po kolonama u odnosu na skladištenje po redovima?
Čime se razlikuje RANK od DENSE_RANK?
Можете ли да објасните партиционисање у Oracle-у: зашто се користи и какве врсте постоје?
Kako funkcioniše particionisanje u Hive-u i kako je fizički predstavljeno u datotečnom sistemu?