Compare os abordagens Data Vault na MCHS e na X5. Quais os benefícios trazidos pelos novos objetos (ponte, tabelas pit)?
Data Engineer
Que tipos de distribuição utilizou? Como escolheu a chave de distribuição?
Com que frequência eram calculadas as vitrinas? Era um cálculo incremental ou completo?
Fale-me sobre a arquitetura do armazenamento: como foi dividido em camadas, quais as características de cada camada?
Fale-me sobre a sua experiência de trabalho
Quais estratégias de carregamento incremental no dbt utilizou?
Quais operadores do Airflow você usou? Como interagiu com o dbt através do Airflow?
Como é que os dados entram no armazenamento no seu local de trabalho atual?
Análise do modelo dbt com estratégia incremental: o que faz o modelo, há problemas?
Que tipos de tabelas no Greenplum utilizou? Em que casos usou heap e em que casos Append-Optimized?
Houve casos de interação com bancos de dados relacionais?
Quais são as características do uso de XCom no Airflow?
Fale sobre índices no Greenplum e ClickHouse
Com que fontes de dados conseguiu trabalhar? Como foi o processo de interação com as fontes?
Fala-me sobre particionamento. Quais operações interessantes tiveste que fazer?
Quem eram os consumidores de dados e como eram construídas as vitrinas?