Oprócz API, jakimi innymi metodami i protokołami pracowałeś z źródłami danych?
Data Engineer
Czy napisałeś procesy ingestion w OpenMetadata, które skanują źródła?
Jaki porządek lub typ kompresji jest używany w Parquet?
Jak pracowali z 1C: pobierali dane bezpośrednio z bazy danych, przez magistralę lub w inny sposób?
Co się działo, gdy uruchamiano ograniczenie jakości danych: alert, awaria, ponowne uruchomienie?
Dlaczego użyto Parquet zamiast ORC?
Do czego służą "foldery"/prefiksy w S3 oprócz wygody?
Jakie pola techniczne były używane w satellites, links i hubs Data Vault?
Czy przechowywaliście wyniki widoków tabelarycznych w Parquet lub w inny sposób w S3?
Czy pracowałeś z FTP w celu uzyskania plików lub danych przez portal?
Czy konfigurowałeś tagi w S3 na bucketach lub obiektach?
Jak ustalili, że wpis już istnieje i nie trzeba go ponownie zapisywać?
Z jakimi formatami plików pracowałeś?