Σε ποια πεδία διανέμεις τα δεδομένα στο Greenplum;
Data Engineer
Γενικά, πες μας για την εμπειρία σου και τι μελέτησες.
Έχετε εργαστεί με Kafka;
Γιατί αποφάσισες να φύγεις από το τρέχον έργο σου; Τι σε απογοητεύει εκεί;
Πώς διαφέρει το Hive από το Impala;
Έχεις κατασκευάσει πίνακες ελέγχου και έχεις εργαστεί με εργαλεία οπτικοποίησης δεδομένων (εργαλεία BI);
Έχεις αναλάβει ad-hoc εργασίες παρά το ότι υπάρχει σαφές τεχνικό δελτίο, και πώς αντιμετωπίζεις τα ad-hoc αιτήματα και τις αλλαγές προτεραιότητας;
Ποιες είναι οι προσδοκίες σου από ένα νέο έργο;
Έχεις αντιμετωπίσει συγκρούσεις στην ομάδα ή με έναν διευθυντή; Πώς το διαχειρίστηκες; Δώσε παραδείγματα.
Είσαι εξοικειωμένος με τους OLAP κύβους; Όταν εργαζόμαστε με πολυδιάστατα δεδομένα, παρόμοια με έναν πίνακα Pivot στο Excel, αλλά για πιο γρήγορη αλληλεπίδραση με μεγάλα όγκο δεδομένων.
Υπάρχουν λειτουργίες και δυνατότητες στο Greenplum που δεν υπάρχουν σε κανονικό MySQL και άλλες διαλέκτους;
Τι κάνατε συνήθως στο PostgreSQL; Δημιουργούσατε δείκτες και τι άλλο κάνατε μέσα στη βάση δεδομένων;
Ποια είναι η διαφορά μεταξύ VACUUM και VACUUM FULL στο PostgreSQL;
Πείτε μας πώς χρησιμοποιήσατε το Hadoop/HDFS/Hive.
Έχουμε ένα ORDER BY κατά τον αριθμό παραγγελιών, και υπάρχουν δύο παραγγελίες με 5, άλλες δύο με 3. Πώς θα συμπεριφερθούν τα RANK() και DENSE_RANK();
Πώς υλοποιήθηκε ο προσαρμοσμένος χειριστής Airflow: μέσω BashOperator;
Σε ποια σειρά πραγματοποιούνται οι βασικές λειτουργίες στη SQL: SELECT, FROM κ.λπ.;
Σε ποιες περιπτώσεις ταιριάζει καλύτερα το Nested Loop Join;
Πραγματοποιείτε αυτήν τη στιγμή συνεντεύξεις; Έχετε προσφορές ή βρίσκεστε στα τελικά στάδια, ειδικά σε τράπεζες;
Πείτε μας για τις εργασίες Spark: τι γράψατε, ποιες αφαιρέσεις και λειτουργίες χρησιμοποιήσατε;