Ar dirbote su Kafka?
Data Engineer
Apskritai papasakok apie savo patirtį ir ką mokaisi.
Kodėl nusprendei palikti savo dabartinį projektą? Kas tau ten nepatinka?
Kaip Hive skiriasi nuo Impala?
Kodėl paliekate savo dabartinį darbą?
Ar turėjote ad-hoc užduočių, nepaisant aiškios techninės specifikacijos, ir kaip žiūrite į ad-hoc užklausas ir prioritetų keitimus?
Kokių tikitės naujame projekte?
Ar kūrei valdymo skydelius ir dirbote su duomenų vizualizavimo įrankiais (BI įrankiai)?
Ar pažįsti OLAP kubus? Kai dirbame su daugiamačiais duomenimis, panašiais į „Excel“ pivot lentelę, bet greitesniam sąveikavimui su dideliais duomenų kiekiais.
Ar Greenplum turi funkcijų ir galimybių, kurių nėra įprastame MySQL ir kituose dialektuose?
Ką dažniausiai darėte PostgreSQL? Ar kūrėte indeksus ir ką dar darėte duomenų bazėje?
Papaskokite, kaip naudojote Hadoop/HDFS/Hive.
Kuo skiriasi VACUUM ir VACUUM FULL PostgreSQL?
Turime ORDER BY pagal užsakymų skaičių, ir yra du užsakymai po 5, dar du po 3. Kaip elgsis RANK() ir DENSE_RANK()?
Kaip buvo įgyvendintas individualus Airflow operatorius: per BashOperator?
Kokiose situacijose yra tinkamiausias Nested Loop Join?
Kokia tvarka vykdomos pagrindinės SQL operacijos: SELECT, FROM ir kt.?
Ar šiuo metu dalyvaujate pokalbiuose? Ar turite pasiūlymų arba esate finalinėse stadijose, ypač bankuose?
Ar susidūrėte su konfliktais komandoje ar su vadovu? Kaip tai sprendėte? Pateikite pavyzdžių.
Papaskokite apie Spark užduotis: ką rašėte, kokias abstrakcijas ir operacijas naudojote?