Ce ordine sau tip de compresie este utilizat în Parquet?
Data Engineer
Pe lângă API, cu ce alte metode și protocoale ați lucrat cu sursele de date?
Ai scris procese de ingestie în OpenMetadata care scanează sursele?
De ce s-a folosit Parquet în loc de ORC?
Cum lucrau cu 1C: extrăgeau date direct din baza de date, printr-un bus sau în alt mod?
Ce se întâmpla atunci când se activa restricția de calitate a datelor: alertă, cădere, repornire?
La ce sunt utile "dosarele"/prefixele în S3 în afară de comoditate?
Ce câmpuri tehnice au fost utilizate în satellites, links și hubs Data Vault?
Ați stocat rezultatele vizualizărilor tabelare în Parquet sau altfel în S3?
Ați lucrat cu FTP pentru a obține fișiere sau date prin portal?
Ați configurat etichete în S3 pe bucket-uri sau pe obiecte?
Cum ați determinat că înregistrarea există deja și nu este nevoie să o înregistrați din nou?
Cu ce formate de fișiere ai lucrat?