Kādus rīkus izmantoja izstrādes laikā?
System Analyst
Vai projektā izmantojāt Kafka/RabbitMQ datu straumju apstrādei? Ko tieši darījāt?
Kādas parasti tika konfigurētas pamata datu kvalitātes pārbaudes?
Rezumé bija minēta Kafka — kas tas ir, vai to ir izmantojuši?
-- 1. Izvēlieties klientus bez pasūtījumiem pēdējā mēnesī. -- Struktūra: -- customers (customer_id, name, registration_date) -- orders (order_id, customer_id, order_date, amount) SELECT DISTINCT c.customer_id, c.name FROM customers c LEFT JOIN orders o ON c.customer_id = o.customer_id and o.order_date >= DATE_TRUNC('month', CURRENT_DATE) - INTERVAL '1 month') WHERE o.amount IS NULL -- 2. Aprēķiniet katras apakškategorijas daļu kopējā kategorijas ieņēmumos -- sales (product_id, category, subcategory, revenue, sale_date) -- Sagaidāmais rezultāts: category | subcategory | share_of_category
Pastāstiet par projektu [organizācija] par DWH un gandrīz reāllaika analītiku būvobjektos: kādi uzdevumi tika uzstādīti, kā tie tika risināti, kādi sasniegumi?
Pastāstiet par savu pieredzi — ar ko nodarbojāties dažādos projektos (konsultācijas, [organizācija], Econsoft, Beeline)?
-- 1. Izvadiet klientu sarakstu bez pasutijumiem pēdējā mēnesī. -- Struktūra: -- customers (customer_id, name, registration_date) -- orders (order_id, customer_id, order_date, amount) SELECT DISTINCT c.customer_id, c.name FROM customers c LEFT JOIN orders o ON c.customer_id = o.customer_id and o.order_date >= DATE_TRUNC('month', CURRENT_DATE) - INTERVAL '1 month' WHERE o.amount IS NULL -- 2. Aprēķiniet katras apakškategorijas daļu kopējā kategorijas ieņēmumos -- sales (product_id, category, subcategory, revenue, sale_date) -- Nepieciešamais rezultāts: category | subcategory | share_of_category
Pastāstiet par CI/CD iestatījumiem un konteinerizāciju Docker projektā — ko tieši darījāt?
Vai datu ielāde pati tika uzrakstīta tieši Python?
Vai jūs varat paskaidrot, kādus pieejas datu glabātuves arhitektūras projektēšanā esat izmantojis? Vismaz teorētiski.
Vai jums ir pieredze optimizācijā ClickHouse (ieskaitot datu ielādi)?
Komandā bija divi datu inženieri, kas nodarbojās ar īstenošanu, un jūs atbildējāt par arhitektūru un prasībām — vai tas ir pareizi?
Cik labi pazīstat Data Vault, tā objektu tipus (Hub, Link, Satellite) un projektēšanas pieeju?
Vai jūs strādājāt ar datu kvalitāti? Vai izmantojāt pārbaudes sistēmu?
Kādu lomu jūs pildījāt visos šajos projektos: kā izstrādātājs vai kā analītiķis, kurš nosaka prasības izstrādātājiem?