Pracoval jste s Kafka?
Data Engineer
Řekni mi obecně o své zkušenosti a co jsi studoval.
Proč jste se rozhodl opustit svůj současný projekt? Co vás tam neuspokojuje?
Měl jsi ad-hoc úkoly i přes jasné zadání, a jak se stavíš k ad-hoc požadavkům a změnám priorit?
Jaká jsou vaše očekávání od nového projektu?
Proč opouštíte svou současnou práci?
V čem se Hive liší od Impala?
Stavěl jsi dashboardy a pracoval s nástroji vizualizace dat (BI nástroje)?
Znáš OLAP kostky? Když pracujeme s vícerozměrnými daty, podobnými kontingenční tabulce v Excelu, ale pro rychlejší interakci s velkými objemy dat.
Existují v Greenplum funkce a možnosti, které nejsou v běžném MySQL a dalších dialektech?
Povězte nám, jak jste použili Hadoop/HDFS/Hive.
Co jste obvykle dělali v PostgreSQL? Vytvářeli jste indexy a co ještě jste dělali uvnitř databáze?
Máme ORDER BY podle počtu objednávek, a jsou zde dvě objednávky s 5, další dvě s 3. Jak se budou chovat RANK() a DENSE_RANK()?
V jakých případech je nejvhodnější Nested Loop Join?
V jakém pořadí se provádějí hlavní operace v SQL: SELECT, FROM atd.?
Jaký je rozdíl mezi VACUUM a VACUUM FULL v PostgreSQL?
Jak byl implementován vlastní operátor Airflow: přes BashOperator?
Aktuálně se účastníte pohovorů? Máte nabídky nebo jste ve finálních fázích, zejména v bankách?
Povězte nám o úlohách Spark: co jste napsali, jaké abstrakce a operace jste použili?
Setkali jste se s konflikty v týmu nebo s manažerem? Jak jste to řešil? Uveďte příklady.