Какъв ред или тип компресия се използва в Parquet?
Data Engineer
Освен API, с какви други методи и протоколи работихте с източниците на данни?
Как работеха с 1C: взимаха данни директно от базата данни, чрез шината или по друг начин?
Написахте ли процеси за въвеждане в OpenMetadata, които сканират източниците?
Какво се случваше, когато се активираше ограничението за качество на данните: предупреждение, срив, рестарт?
Защо използвахме Parquet вместо ORC?
За какво са нужни "папки"/префикси в S3 освен за удобство?
Кои технически полета бяха използвани в satellites, links и hubs Data Vault?
Работили ли сте с FTP за получаване на файлове или данни чрез портала?
Запазихте ли резултатите от таблицата изгледи в Parquet или по друг начин в S3?
Настройвали ли сте тагове в S3 на кофи или обекти?
Как определихте, че записът вече съществува и не е необходимо да го записвате отново?
С кои файлови формати работихте?