Qual é a ordem ou tipo de compressão usado no Parquet?
Data Engineer
Para além da API, que outros métodos e protocolos utilizou para trabalhar com as fontes de dados?
Escreveste processos de ingestão no OpenMetadata que escaneiam as fontes?
Por que usaram Parquet em vez de ORC?
Como trabalhavam com 1C: extraíam dados diretamente do banco de dados, através de um barramento ou de outra forma?
O que acontecia quando a restrição de qualidade dos dados era acionada: alerta, queda, reinício?
Para que servem as "pastas"/prefixos no S3 além de conveniência?
Quais campos técnicos foram utilizados em satellites, links e hubs Data Vault?
Já trabalhou com FTP para obter ficheiros ou dados através do portal?
Armazenaram os resultados de visualizações tabulares em Parquet ou de outra forma no S3?
Configuraram tags no S3 em buckets ou objetos?
Como determinaram que a entrada já existe e que não é necessário gravá-la novamente?
Com que formatos de ficheiros trabalhou?