Pracovali ste s Kafka?
Data Engineer
Všeobecne povedz o svojich skúsenostiach a čo si študoval.
Ako sa Hive líši od Impala?
Prečo si sa rozhodol opustiť svoj aktuálny projekt? Čo ťa tam neuspokojilo?
Prečo odchádzate zo súčasnej práce?
Mal si ad-hoc úlohy aj napriek jasnému zadaniu, a ako sa staviaš k ad-hoc požiadavkám a zmenám priorít?
Aké sú vaše očakávania od nového projektu?
Staval si dashboardy a pracoval s nástrojmi na vizualizáciu dát (BI nástroje)?
Poznáš OLAP kostky? Keď pracujeme s viacrozmernými údajmi, podobnými kontingenčnej tabuľke v Exceli, ale pre rýchlejšiu interakciu s veľkými objemami údajov.
Existujú v Greenplum funkcie a možnosti, ktoré nie sú v bežnom MySQL a iných dialektoch?
Čo ste zvyčajne robili v PostgreSQL? Vytvárali ste indexy a čo ešte ste robili v databáze?
Aký je rozdiel medzi VACUUM a VACUUM FULL v PostgreSQL?
Povedzte nám, ako ste použili Hadoop/HDFS/Hive.
Máme ORDER BY podľa počtu objednávok, a máme dve objednávky s 5, ďalšie dve s 3. Ako sa budú správať RANK() a DENSE_RANK()?
Ako bol implementovaný vlastný operátor Airflow: cez BashOperator?
V ktorých prípadoch je najvhodnejší Nested Loop Join?
V akom poradí sa vykonávajú hlavné operácie v SQL: SELECT, FROM atď.?
Aktuálne sa zúčastňujete pohovorov? Máte ponuky alebo ste v posledných fázach, najmä v bankách?
Stretli ste sa s konfliktmi v tíme alebo s manažérom? Ako ste to riešili? Uveďte príklady.
Prečo je v ClickHouse potrebný MergeTree?