Papildus API, ar kādiem citiem veidiem un protokoliem jūs strādājāt ar datu avotiem?
Data Engineer
Kāda kārtība vai saspiešanas veids tiek izmantots Parquet?
Vai jūs rakstījāt OpenMetadata ingest procesu, kas skenē avotus?
Kā strādāja ar 1C: tieši no datu bāzes ņēma datus, vai caur shēnu vai citādi?
Kāpēc tika izmantots Parquet, nevis ORC?
Kas notika, kad datu kvalitātes ierobežojums tika aktivizēts: brīdinājums, kritums, pārstartēšana?
Kam ir nepieciešamas "mapes"/prefiksi S3, papildus ērtībai?
Kādus tehniskos laukus izmantoja satellites, links un hubs Data Vault?
Vai esat strādājis ar FTP, lai saņemtu failus vai datus caur portālu?
Vai S3 glabājāt tabulas skatu rezultātus Parquet vai citādi?
Vai jūs konfigurējāt tagus S3 uz groziem vai objektiem?
Kā noteicāt, ka ieraksts jau pastāv un to atkārtoti ierakstīt nav nepieciešams?
Ar kādiem failu formātiem jūs strādājāt?