Ai lucrat cu Kafka?
Data Engineer
Povestește în general despre experiența ta și ce ai studiat.
De ce ai decis să părăsești proiectul tău actual? Ce nu te mulțumește acolo?
De ce părăsiți actualul loc de muncă?
Ai avut sarcini ad-hoc chiar și cu un brief clar, și cum te raportezi la cererile ad-hoc și schimbările de priorități?
Care sunt așteptările tale de la un nou proiect?
Cum diferă Hive de Impala?
Ai construit panouri de control și ai lucrat cu instrumente de vizualizare a datelor (instrumente BI)?
Ești familiarizat cu cuburile OLAP? Când lucrăm cu date multidimensionale, asemănătoare cu un tabel pivot în Excel, dar pentru o interacțiune mai rapidă cu volume mari de date.
Există funcții și capabilități în Greenplum care nu sunt în MySQL obișnuit și alte dialecte?
Ce obișnuiai să faci în PostgreSQL? Creai indecși și ce altceva făceai în interiorul bazei de date?
Spune-ne cum ai folosit Hadoop/HDFS/Hive.
Care este diferența dintre VACUUM și VACUUM FULL în PostgreSQL?
Avem un ORDER BY după numărul de comenzi, și avem două comenzi cu 5, alte două cu 3. Cum se vor comporta RANK() și DENSE_RANK()?
În ce cazuri este cel mai potrivit Nested Loop Join?
În ce ordine se realizează operațiile principale în SQL: SELECT, FROM etc.?
Cum a fost implementat operatorul personalizat Airflow: prin BashOperator?
Participați în prezent la interviuri? Aveți oferte sau sunteți în etapele finale, în special în bănci?
Ai avut conflicte în echipă sau cu un manager? Cum ai gestionat situația? Oferă exemple.
Spune-ne despre sarcinile Spark: ce ai scris, ce abstracții și operații ai folosit?