Hogyan működik az Oracle lekérdezés-optimalizálója, mire figyel és melyik osztályhoz tartozik?
Data Engineer
Mi az értelme az adatok blokkokra bontásának az HDFS-ben?
Hogyan dolgoztál az Impala-val?
Miben különbözik az HDFS a szokásos elosztott fájlrendszerektől?
Hogyan működik a MapReduce, különösen a Reduce szakasz?
Mi az a YARN és mire való?
Hogyan dolgoztak a CI/CD-vel?
Hogyan töltötte be az adatokat az S3-ból a Greenplum-ba?
Mi az a shuffle a Sparkben és miért fontos minimalizálni?
Hogyan nézhető meg egy lekérdezés végrehajtási terve Oracle-ben? Miben különbözik az EXPLAIN PLAN az EXPLAIN ANALYZE-től?
Meséljen a PL/SQL eljárások használatáról a munkájában.
Mi az a broadcast join a Spark-ben?
Szükség volt-e valaha Oracle-ban csomagokat írni?
Van tapasztalata Spark feladatok optimalizálásában? Tudna egy konkrét példát mondani?
Dolgozott inkrementális és teljes betöltésekkel? Hogyan kezelte a duplikátumokat?
Hogyan olvasódik egy HDFS-fájl, például Parquet — teljes egészében vagy blokkokban?
Mi a különbség a RANK és a DENSE_RANK között?
Mi az oszlop alapú tárolás előnye a sor alapú tároláshoz képest?
Mondja el az Oracle partícionálásáról: mire használják és milyen típusai vannak?
Hogyan működik a partícionálás a Hive-ben, és hogyan van fizikailag ábrázolva a fájlrendszerben?