O que podes contar-me sobre a API SOAP?
Data Engineer
Como executaram os DAGs: por cron, datasets, triggers ou dependências?
Que verificações de qualidade de dados foram realizadas no Data Vault?
Como se conectaram ao OpenMetadata e o que fizeram com ela?
Como rastrear em qual execução do DAG uma linha específica apareceu no Data Vault?
Dê um exemplo de uma tarefa típica de escrita de DAG no Airflow.
Você administrou o Airflow ou trabalhou apenas como desenvolvedor?
Como otimizaram as tabelas e consultas: partições, índices, lógica de seleção?
É possível usar distribuição aleatória no Greenplum e quando é apropriado?
Fala um pouco sobre si: com o que trabalhou, qual stack utilizou e qual foi o projeto?
Que consultas SQL escreves: verificações simples ou scripts complexos para armazéns de dados?
Foi feito um registo adicional além dos logs do Airflow?
Quando é que podes dar feedback e tens ofertas em mãos?
Usaram Bridge e tabelas PIT no Data Vault? Dê um exemplo e explique a finalidade.
Que entidades adicionais do Data Vault, além de hub, link e satellite, foram utilizadas: por exemplo, links same-as ou links transacionais?
O S3 foi o único armazenamento principal ou usaram vários?
Liste as funções de janela SQL que conhece.
Usaram um bucket S3 ou vários? Com que princípio?
Estabeleceram a linhagem desde a fonte até ao consumidor?
Qual o tipo de armazenamento do Parquet: linha ou coluna?