¿Qué herramientas usaron cuando estaban desarrollando?
System Analyst
¿Usaron Kafka/RabbitMQ para procesamiento de datos en streaming en el proyecto? ¿Qué exactamente hicieron?
¿Qué verificaciones básicas de calidad de datos se configuraban normalmente?
En el currículum aparecía Kafka — ¿qué es eso, lo usaron?
Cuéntame sobre el proyecto en [organización] para el desarrollo de DWH y análisis en tiempo casi real de objetos de construcción: ¿qué tareas se plantearon, cómo se resolvieron, cuáles fueron los logros?
Cuéntame sobre tu experiencia: ¿en qué has trabajado en diferentes proyectos (consultoría, [organización], Econsoft, Beeline)?
-- 1. Listar los clientes sin pedidos en el último mes. -- Estructura: -- customers (customer_id, name, registration_date) -- orders (order_id, customer_id, order_date, amount) SELECT DISTINCT c.customer_id, c.name FROM customers c LEFT JOIN orders o ON c.customer_id = o.customer_id and o.order_date >= DATE_TRUNC('month', CURRENT_DATE) - INTERVAL '1 month' WHERE o.amount IS NULL -- 2. Calcular la proporción de cada subcategoría en los ingresos totales de la categoría -- sales (product_id, category, subcategory, revenue, sale_date) -- Resultado necesario: category | subcategory | share_of_category
-- 1. Listar los clientes sin pedidos en el último mes. -- Estructura: -- customers (customer_id, name, registration_date) -- orders (order_id, customer_id, order_date, amount) SELECT DISTINCT c.customer_id, c.name FROM customers c LEFT JOIN orders o ON c.customer_id = o.customer_id and o.order_date >= DATE_TRUNC('month', CURRENT_DATE) - INTERVAL '1 month') WHERE o.amount IS NULL -- 2. Calcular la proporción de cada subcategoría en los ingresos totales de la categoría -- sales (product_id, category, subcategory, revenue, sale_date) -- Resultado esperado: category | subcategory | share_of_category
¿La carga de datos en sí fue escrita directamente en Python?
Cuéntame sobre la configuración de CI/CD y la containerización en Docker en el proyecto — ¿qué exactamente hiciste?
¿Puede contar qué enfoques de diseño de arquitectura de almacenes de datos ha utilizado? Al menos en teoría.
¿Tiene experiencia en optimización en ClickHouse (incluida la carga de datos)?
¿Trabajaron con la calidad de los datos? ¿Usaron algún sistema de verificación?
En el equipo había dos ingenieros de datos que se encargaban de la implementación, y tú eras responsable de la arquitectura y los requisitos, ¿verdad?
¿Qué tan familiarizado estás con Data Vault, sus tipos de objetos (Hub, Link, Satellite) y el enfoque de diseño?
¿Qué papel desempeñaste en todos estos proyectos: como desarrollador o como analista que establece requisitos para los desarrolladores?