Kaip veikia Oracle užklausų optimizatorius, į ką jis žiūri ir kuriai klasei priklauso?
Data Engineer
Koks yra tikslas duomenų skaidymo į blokus HDFS?
Kaip dirbote su Impala?
Kuo HDFS skiriasi nuo įprastų paskirstytų failų sistemų?
Kaip veikia MapReduce, ypač Reduce etapas?
Kas yra YARN ir kam jis reikalingas?
Kaip dirbote su CI/CD?
Kaip įkėlėte duomenis iš S3 į Greenplum?
Kas yra shuffle Spark ir kodėl svarbu jį sumažinti?
Kaip peržiūrėti užklausos vykdymo planą Oracle? Kuo skiriasi EXPLAIN PLAN nuo EXPLAIN ANALYZE?
Papaskinkite apie PL/SQL procedūrų naudojimą jūsų darbe.
Kas yra broadcast join Spark?
Ar turite patirties optimizuojant Spark užduotis? Ar galite pateikti konkretų pavyzdį?
Ar kada nors teko rašyti paketus Oracle?
Ar dirbote su inkrementiniais ir pilnais įkėlimais? Kaip kovojote su dubletais?
Kuo skiriasi RANK nuo DENSE_RANK?
Kas yra Hive ir kuo jis skiriasi nuo tradicinių reliacinių duomenų bazių?
Kuo skiriasi stulpelinė saugykla nuo eilutės?
Kaip skaitomas HDFS failas, pavyzdžiui Parquet — visą ar blokais?
Gal galite paaiškinti partitioning Oracle: kam jis naudojamas ir kokie yra jo tipai?