Ποια σειρά ή τύπος συμπίεσης χρησιμοποιείται στο Parquet;
Data Engineer
Πέρα από το API, με ποιους άλλους τρόπους και πρωτόκολλα εργάστηκες με τις πηγές δεδομένων;
Πώς δούλευαν με το 1C: έπαιρναν δεδομένα απευθείας από τη βάση δεδομένων, μέσω ενός διαύλου ή με άλλο τρόπο;
Έγραψες διαδικασίες εισαγωγής στο OpenMetadata που σαρώνουν τις πηγές;
Τι συνέβαινε όταν ενεργοποιούνταν ο περιορισμός ποιότητας δεδομένων: ειδοποίηση, πτώση, επανεκκίνηση;
Γιατί χρησιμοποιήθηκε το Parquet αντί για το ORC;
Γιατί χρειάζονται "φάκελοι"/προθέματα στο S3 εκτός από την ευκολία;
Ποια τεχνικά πεδία χρησιμοποιήθηκαν σε satellites, links και hubs Data Vault;
Έχετε εργαστεί με FTP για την λήψη αρχείων ή δεδομένων μέσω της πύλης;
Αποθηκεύσατε τα αποτελέσματα των πίνακων προβολών σε Parquet ή με άλλο τρόπο στο S3;
Ρυθμίσατε ετικέτες στο S3 σε buckets ή αντικείμενα;
Πώς προσδιορίσατε ότι η εγγραφή υπάρχει ήδη και δεν χρειάζεται να καταχωρηθεί ξανά;
Με ποια μορφές αρχείων εργάστηκες;