Aké poradie alebo typ kompresie sa používa v Parquet?
Data Engineer
Okrem API ste s dátovými zdrojmi pracovali akými spôsobmi a protokolmi?
Napísal si ingest procesy pre OpenMetadata, ktoré skenujú zdroje?
Prečo sme použili Parquet namiesto ORC?
Ako pracovali s 1C: získavali údaje priamo z databázy, cez zbernicu alebo iným spôsobom?
Čo sa dialo, keď sa spustilo obmedzenie kvality údajov: upozornenie, pád, reštart?
Na čo sú v S3 potrebné "zložky"/predpony okrem pohodlia?
Aké technické polia sa používali v satellites, links a hubs Data Vault?
Pracoval ste s FTP na získanie súborov alebo údajov cez portál?
Ukladali ste výsledky tabuľkových zobrazení v Parquet alebo inak v S3?
Nastavili ste značky v S3 na bucketoch alebo objektoch?
Ako ste zistili, že záznam už existuje a nie je potrebné ho znovu zaznamenať?
S akými formátmi súborov ste pracovali?