Que ferramentas usaram durante o desenvolvimento?
System Analyst
Usaram Kafka/RabbitMQ para processamento de dados em fluxo no projeto? O que exatamente fizeram?
Que verificações básicas de qualidade de dados eram normalmente configuradas?
No currículo, Kafka foi mencionado — o que é isso, foi utilizada?
-- 1. Listar clientes sem pedidos no último mês. -- Estrutura: -- customers (customer_id, name, registration_date) -- orders (order_id, customer_id, order_date, amount) SELECT DISTINCT c.customer_id, c.name FROM customers c LEFT JOIN orders o ON c.customer_id = o.customer_id and o.order_date >= DATE_TRUNC('month', CURRENT_DATE) - INTERVAL '1 month') WHERE o.amount IS NULL -- 2. Calcular a proporção de cada subcategoria na receita total da categoria -- sales (product_id, category, subcategory, revenue, sale_date) -- Resultado esperado: category | subcategory | share_of_category
Fale sobre o projeto na [organização] para o desenvolvimento de DWH e análise near real-time de objetos de construção: quais eram as tarefas, como as resolveram, quais foram as conquistas?
Fale sobre a sua experiência — com o que trabalhou em diferentes projetos (consultoria, [organização], Econsoft, Beeline)?
-- 1. Listar clientes sem pedidos no último mês. -- Estrutura: -- customers (customer_id, name, registration_date) -- orders (order_id, customer_id, order_date, amount) SELECT DISTINCT c.customer_id, c.name FROM customers c LEFT JOIN orders o ON c.customer_id = o.customer_id and o.order_date >= DATE_TRUNC('month', CURRENT_DATE) - INTERVAL '1 month' WHERE o.amount IS NULL -- 2. Calcular a proporção de cada subcategoria na receita total da categoria -- sales (product_id, category, subcategory, revenue, sale_date) -- Resultado esperado: category | subcategory | share_of_category
Fale-me sobre a configuração de CI/CD e a containerização no Docker no projeto — o que exatamente fizeram?
A própria carga de dados foi escrita diretamente em Python?
Pode explicar quais abordagens de conceção de arquitetura de armazéns de dados utilizou? Pelo menos teoricamente.
Havia dois engenheiros de dados na equipa, que se ocupavam da implementação, e você era responsável pela arquitetura e requisitos — correto?
Tem experiência em otimização no ClickHouse (incluindo carregamento de dados)?
Já trabalharam com a qualidade dos dados? Utilizaram algum sistema de verificação?
Qual o seu nível de familiaridade com Data Vault — com os tipos de objetos (Hub, Link, Satellite) e a abordagem de design?
Qual foi o seu papel em todos esses projetos: como desenvolvedor ou como analista que define requisitos para os desenvolvedores?