Sobes.tech

Data Engineer

Τι είναι το ACID; Τι σημαίνει κάθε γράμμα; Πώς σχετίζεται αυτό με τις συναλλαγές;

182

Μίλησε γενικά για τις σχεσιακές βάσεις δεδομένων — τι είναι αυτές;

181

Πότε δεν χρειαζόμαστε αποθήκευση δεδομένων;

179

Έχεις εμπειρία με εικόνες Docker, ρυθμίζοντας περιβάλλον σε εικονική μηχανή;

177

Αναφέρεις τις διαδικασίες Docker, μπορείς να εξηγήσεις περισσότερα για το πώς είναι οργανωμένο αυτό στην εταιρεία σας;

177

Τι είναι ο τύπος πάπιας (duck typing);

176

Ποιοι είναι οι περιορισμοί στη χρήση των κατακερματιστικών πινάκων;

175

Πώς είναι οργανωμένο το QA σας (έλεγχος ποιότητας δεδομένων);

174

Ποια είναι η διαφορά μεταξύ ανακατασκευής και βελτιστοποίησης;

172

Ποιοι είναι οι τύποι φυσικών συνδέσεων (μέθοδοι σύνδεσης);

170

Έχετε εμπειρία με το Table Engine Join στο ClickHouse;

169

Τι είναι ένα σχέδιο ερωτήσεων; Ποιος είναι ο σκοπός τους;

168

Μπορείτε να μου πείτε για την εμπειρία σας με κατανεμημένες βάσεις δεδομένων (Greenplum, ClickHouse);

167

Τι δεν σου αρέσει αυτήν τη στιγμή στη δουλειά σου;

166

Έχετε εμπειρία με μηχανές όπως Trino ή με μορφές πινάκων (Iceberg, Parquet) στο Spark;

166

Υποθέστε ότι το Data Vault δεν είναι διαθέσιμο και υπάρχουν δύο ευρείες πίνακες που πρέπει να ενώσετε. Πώς θα το βελτιστοποιούσατε αυτό στο Greenplum; Και αν ήταν στο ClickHouse;

165

Μπορεί να σκεφτεί κανείς κάτι άλλο αντί για ένα κανονικό CTE, λαμβάνοντας υπόψη ότι η φιλτράρισμα εξακολουθεί να γίνεται στη μνήμη σε ολόκληρο τον πίνακα;

163

Για ποιο λόγο χρειαζόσασταν γενικά το Data Vault;

157

Σε ποιο περιβάλλον ξεκίνησε το Spark;

157
/3