Koji red ili tip kompresije se koristi u Parquet?
Data Engineer
Pored API-ja, kojim drugim metodima i protokolima ste radili sa izvorima podataka?
Kako su radili sa 1C: preuzimali su podatke direktno iz baze podataka, putem šine ili na drugi način?
Da li si napisao procese ingestion-a za OpenMetadata koji skeniraju izvore?
Šta se dešavalo kada se aktiviralo ograničenje kvaliteta podataka: upozorenje, pad, ponovni pokretanje?
Zašto smo koristili Parquet umesto ORC?
Zašto su u S3 potrebne "fajl strukture"/prefiksi osim za udobnost?
Koja tehnička polja su korišćena u satellites, links i hubs Data Vault?
Да ли сте радили са FTP-ом за добијање датотека или података преко портала?
Da li ste u S3 čuvali rezultate tabelarnih prikaza u Parquet ili na drugi način?
Da li ste konfigurirali oznake u S3 na bucket-ovima ili objektima?
Kako ste odredili da zapis već postoji i da ga nije potrebno ponovo zapisivati?
Са којим форматима датотека сте радио?