Be API, kokiais kitais būdais ir protokolais dirbote su duomenų šaltiniais?
Data Engineer
Koks tvarkos ar tipo suspaudimo naudojamas Parquet?
Ar parašėte OpenMetadata įkėlimo procesus, kurie skenuoja šaltinius?
Kaip dirbo su 1C: ar tiesiogiai iš duomenų bazės paimdavo duomenis, ar per magistralę ar kitaip?
Kas vykdavo, kai duomenų kokybės apribojimas įvykdavo: įspėjimas, kritimas, perkrovimas?
Kodėl naudotas Parquet vietoj ORC?
Kam reikalingos "katalogai"/prekių ženklai S3, გარდა patogumo?
Kokius techninius laukus naudojo satellites, links ir hubs Data Vault?
Ar saugojote lentelinių vaizdų rezultatus S3, naudodami Parquet ar kitaip?
Ar dirbote su FTP, kad gautumėte failus ar duomenis per portalą?
Ar jūs nustatėte žymas S3 ant kibirų ar objektų?
Kaip nustatėte, kad įrašas jau egzistuoja ir jo pakartotinai įrašyti nereikia?
Su kokiais failų formatais dirbote?