Sobes.tech

Data Engineer

Πώς λειτουργεί ο βελτιστοποιητής ερωτημάτων στην Oracle, τι κοιτάζει και σε ποια κατηγορία ανήκει;

Middle
290

Ποιος είναι ο σκοπός του διαχωρισμού των δεδομένων σε μπλοκ στο HDFS;

Middle
272

Πώς δούλευες με το Impala;

Middle
247

Πώς διαφέρει το HDFS από τα συνηθισμένα κατανεμημένα συστήματα αρχείων;

Middle
231

Πώς λειτουργεί το MapReduce, ειδικά η φάση Reduce;

Middle
215

Τι είναι το YARN και ποιος είναι ο σκοπός του;

Middle
211

Πώς εργάστηκαν με CI/CD;

Middle
210

Πώς φορτώσατε δεδομένα από το S3 στο Greenplum;

Middle
199

Τι είναι το shuffle στο Spark και γιατί είναι σημαντικό να το ελαχιστοποιήσουμε;

Middle
194

Πώς βλέπετε το σχέδιο εκτέλεσης ενός ερωτήματος στην Oracle; Πώς διαφέρει το EXPLAIN PLAN από το EXPLAIN ANALYZE;

Middle
185

Πείτε μας για τη χρήση των διαδικασιών PL/SQL στην εργασία σας.

Middle
182

Τι είναι η broadcast join στο Spark;

Middle
179

Έχετε εμπειρία στη βελτιστοποίηση εργασιών Spark; Μπορείτε να δώσετε ένα συγκεκριμένο παράδειγμα;

Middle
178

Έχετε εργαστεί με αυξήσεις και πλήρεις φορτώσεις; Πώς αντιμετωπίσατε τα διπλότυπα;

Middle
178

Έχετε χρειαστεί ποτέ να γράψετε πακέτα σε Oracle;

Middle
176

Τι είναι το Hive και πώς διαφέρει από τις παραδοσιακές σχεσιακές βάσεις δεδομένων;

Middle
175

Πώς διαβάζεται ένα αρχείο από το HDFS, π.χ. Parquet — ολόκληρο ή κατά μπλοκ;

Middle
169

Ποια είναι η διαφορά μεταξύ RANK και DENSE_RANK;

Middle
169

Ποιο είναι το πλεονέκτημα της αποθήκευσης κατά στήλη έναντι της αποθήκευσης κατά γραμμή;

Middle
168

Πώς λειτουργεί η διαμέριση στο Hive και πώς παρουσιάζεται φυσικά στο σύστημα αρχείων;

Middle
166
/3