Kada galima naudoti CSV formatų šeimą?
Data Engineer
Ar naudojote XCom Airflow?
Gal galite paaiškinti partitioning Oracle: kam jis naudojamas ir kokie yra jo tipai?
Ar galima peržiūrėti lentelės schemą prieš vykdant užklausą Hive?
Kas yra Oracle matomosios (VIEW) ir materializuotos (MATERIALIZED VIEW) peržiūros? Kaip atnaujinami duomenys materializuotoje peržiūroje?
Kas yra tingios operacijos Spark ir kam jos reikalingos?
Kokie kiti failo formatai, išskyrus Parquet, gerai veikia su Hadoop ir Hive?
Ar EXPLAIN vykdymo planas visada atitinka tai, kas iš tikrųjų vyksta?
Kaip jūsų patirtis atitinka pareigas: įkėlimo procesų palydėjimas ir analizė, anomalijų stebėjimas ir nustatymas, testavimas ir patobulinimų diegimas gamyboje, antros eilės palaikymas, techninės dokumentacijos patikrinimas?
Papaskink apie savo ankstesnį projektą, kokios buvo tavo pareigos?
Ar teko jums dirbti su Oracle Data Integrator (ODI)?
Kaip sužinoti tikrąjį užklausos vykdymo planą Oracle?
Ar galite prisiminti savo patirtį optimizuojant užklausas? Kaip veikėte, analizavote?
Kokios yra paskirstytų duomenų bazių sistemų privalumai ir trūkumai?
Kuo skiriasi daugiagyslumas nuo daugiaprocesiškumo? Kokiems užduotims naudoti srautus, o kokiems procesus?
Ar dirbote su batch įkėlimu ar srautiniu duomenų perdavimu?
Hive'e įvyko lėtas analitinis užklausa. Kaip suprasti, kas su ja nutiko ir kaip ją pataisyti?
Kodėl skiriamos peržiūros (VIEW) ir lentelės? Kam skirtos peržiūros?
Ar dirbote su lango funkcijomis? Kokias lango funkcijų rūšis žinai?
Ar turite patirties su FastAPI?