Dolgozott Kafka-val?
Data Engineer
Hogyan különbözik a Hive az Impala-tól?
Mesélj általánosságban a tapasztalataidról és arról, mit tanultál.
Miért döntöttél úgy, hogy elhagyod a jelenlegi projektedet? Mi nem tetszik ott?
Miért hagyja el jelenlegi munkahelyét?
Volt már ad-hoc feladatod egyértelmű műszaki specifikáció mellett, és hogyan viszonyulsz az ad-hoc kérésekhez és a prioritások változtatásához?
Mik a várakozásaid egy új projekttől?
Készítettél irányítópultokat és dolgoztál adatvizualizációs eszközökkel (BI-eszközök)?
Ismered az OLAP-kockákat? Amikor többdimenziós adatokkal dolgozunk, hasonlóak egy Excel-pivot táblához, de gyorsabb interakciót tesznek lehetővé nagy adatmennyiségekkel.
Vannak-e olyan funkciók és lehetőségek a Greenplumban, amelyek nem találhatók meg a szokásos MySQL-ben és más dialektusokban?
Mit szoktál csinálni PostgreSQL-ben? Indexeket készítettél, és mit még csináltál az adatbázison belül?
Mi a különbség a VACUUM és a VACUUM FULL között a PostgreSQL-ben?
Meséljen arról, hogyan használta a Hadoop/HDFS/Hive-t.
Nekünk van ORDER BY a megrendelések száma szerint, és két megrendelés 5, még két 3. Hogyan viselkednek a RANK() és a DENSE_RANK()?
Milyen esetekben a Nested Loop Join a legalkalmasabb?
Milyen sorrendben hajtódnak végre az SQL fő műveletei: SELECT, FROM stb.?
Hogyan valósult meg az egyedi Airflow-operator: BashOperator segítségével?
Jelenleg interjúkat tartasz? Van ajánlatod vagy a végső szakaszban vagy, különösen bankokban?
Voltál konfliktusban a csapaton belül vagy egy vezetővel? Hogyan kezelted? Adj példákat.
Meséljen a Spark feladatokról: mit írtál, milyen absztrakciókat és műveleteket használtál?