Jaké nástroje byly použity při vývoji?
System Analyst
Použili jste Kafka/RabbitMQ pro streamové zpracování dat v projektu? Co přesně jste dělali?
Jaké základní kontroly kvality dat se obvykle nastavovaly?
V životopise byla zmíněna Kafka — co to je, používali ji?
Pověz mi o projektu v [organizace] na vývoj DWH a near real-time analytiky stavebních objektů: jaké úkoly byly stanoveny, jak byly řešeny, jaké byly úspěchy?
-- 1. Vypište seznam zákazníků bez objednávek za poslední měsíc. -- Struktura: -- customers (customer_id, name, registration_date) -- orders (order_id, customer_id, order_date, amount) SELECT DISTINCT c.customer_id, c.name FROM customers c LEFT JOIN orders o ON c.customer_id = o.customer_id and o.order_date >= DATE_TRUNC('month', CURRENT_DATE) - INTERVAL '1 month' WHERE o.amount IS NULL -- 2. Spočítejte podíl každé podkategorie na celkovém výnosu kategorie -- sales (product_id, category, subcategory, revenue, sale_date) -- Požadovaný výsledek: category | subcategory | share_of_category
Povězte o svých zkušenostech — čím jste se zabývali na různých projektech (poradenství, [organizace], Econsoft, Beeline)?
-- 1. Vypsat zákazníky bez objednávek za poslední měsíc. -- Struktura: -- customers (customer_id, name, registration_date) -- orders (order_id, customer_id, order_date, amount) SELECT DISTINCT c.customer_id, c.name FROM customers c LEFT JOIN orders o ON c.customer_id = o.customer_id and o.order_date >= DATE_TRUNC('month', CURRENT_DATE) - INTERVAL '1 month') WHERE o.amount IS NULL -- 2. Vypočítat podíl každé podkategorie na celkovém výnosu kategorie -- sales (product_id, category, subcategory, revenue, sale_date) -- Očekávaný výsledek: category | subcategory | share_of_category
Povězte mi o nastavení CI/CD a kontejnerizaci v Dockeru na projektu — co přesně jste dělali?
Bylo načítání dat napsáno přímo v Pythonu?
Můžete vysvětlit, jaké přístupy k navrhování architektury datových skladů jste použili? Alespoň teoreticky.
Máte zkušenosti s optimalizací v ClickHouse (včetně načítání dat)?
Pracovali jste s kvalitou dat? Používali jste systém kontroly?
V týmu byli dva datoví inženýři, kteří se zabývali realizací, a vy jste byli zodpovědní za architekturu a požadavky — je to tak?
Jak dobře znáte Data Vault, jeho typy objektů (Hub, Link, Satellite) a přístup k návrhu?
Jakou roli jste v těchto projektech zastával – jako vývojář nebo jako analytik stanovující požadavky pro vývojáře?