Můžete vysvětlit partitioning v Oracle: k čemu se používá a jaké typy existují?
Data Engineer
Jak funguje rozdělení v Hive a jak je fyzicky znázorněno v souborovém systému?
Co jsou pohledy (VIEW) a materializované pohledy (MATERIALIZED VIEW) v Oracle? Jak jsou aktualizována data v materializovaném pohledu?
Používal jsi XCom v Airflow?
Odpovídá plán provádění z EXPLAIN tomu, co se skutečně provádí?
Jak odpovídá vaše zkušenost pozici: doprovod a analýza procesů načítání, sledování a odhalování anomálií, testování a nasazení vylepšení do produkce, podpora druhé linie, kontrola technické dokumentace?
Co jsou to lenivé operace v Spark a k čemu slouží?
Jak zjistit skutečný plán provádění dotazu v Oracle?
Jaké další formáty souborů, kromě Parquet, dobře fungují s Hadoop a Hive?
Lze před spuštěním dotazu v Hive zobrazit schéma tabulky?
Pověz mi o svém předchozím projektu, jaké byly tvé povinnosti?
Musel jste pracovat s Oracle Data Integrator (ODI)?
Jaká byla vaše architektura v projektu? DWH nebo něco jiného?
Můžeš si vzpomenout na svou zkušenost s optimalizací dotazů? Jak jsi jednal, analyzoval?
V Hive došlo k pomalému analytickému dotazu. Jak pochopit, co se s ním stalo, a jak ho opravit?
Jaké jsou výhody a nevýhody distribuovaných systémů databází?
Pracoval jsi s oknovými funkcemi? Jaké druhy oknových funkcí znáš?
Máte zkušenosti s FastAPI?
Čím se liší vícvláknovost od vícprocesnosti? Pro jaké úkoly používat vlákna a pro jaké procesy?
Pracoval jste s dávkovým nahráváním nebo streamováním?