Ai folosit XCom în Airflow?
Data Engineer
Vorbiți despre partiționare în Oracle: la ce se folosește și ce tipuri există?
Când se pot folosi familiile de formate CSV?
Se poate vedea schema tabelului înainte de a executa interogarea în Hive?
Spune-mi despre proiectul tău anterior, care au fost responsabilitățile tale?
Ce alte formate de fișiere, în afară de Parquet, funcționează bine cu Hadoop și Hive?
Ce sunt vizualizările (VIEW) și vizualizările materializate (MATERIALIZED VIEW) în Oracle? Cum se actualizează datele într-o vizualizare materializată?
Ce sunt operațiile lene în Spark și la ce servesc?
Planul de execuție al EXPLAIN corespunde întotdeauna cu ceea ce se execută efectiv?
Cum se potrivește experiența ta cu responsabilitățile postului: însoțirea și analiza proceselor de încărcare, monitorizarea și identificarea anomaliilor, testarea și instalarea îmbunătățirilor în producție, suport de linia a doua, verificarea documentației tehnice?
Cum să afli planul real de execuție al unei interogări în Oracle?
Ați fost nevoit să lucrați cu Oracle Data Integrator (ODI)?
Care sunt avantajele și dezavantajele sistemelor de baze de date distribuite?
Îți poți aminti experiența ta în optimizarea interogărilor? Cum ai acționat, ai analizat?
Care este diferența dintre multithreading și multiprocessing? Pentru ce sarcini se folosesc firele și pentru ce procesele?
A fost o interogare analitică lentă în Hive. Cum să înțelegi ce s-a întâmplat cu ea și cum să o repari?
De ce se separă vizualizările (VIEW) și tabelele? La ce folosesc vizualizările?
Care a fost arhitectura ta în proiect? DWH sau altceva?
Ai lucrat cu încărcare în lot sau streaming?
Ai lucrat cu funcții de fereastră? Ce tipuri de funcții de fereastră cunoști?