Jakie narzędzia były używane podczas rozwoju?
System Analyst
Czy używaliście Kafka/RabbitMQ do strumieniowego przetwarzania danych w projekcie? Co dokładnie robiliście?
W CV pojawiła się Kafka — co to jest, czy jej używali?
Jakie podstawowe kontrole jakości danych były zwykle konfigurowane?
Opowiedz o projekcie w [organizacja] dotyczącego rozwoju DWH i analityki w czasie niemal rzeczywistym dla obiektów budowlanych: jakie zadania były postawione, jak je rozwiązano, jakie osiągnięcia?
-- 1. Wypisz klientów bez zamówień w ostatnim miesiącu. -- Struktura: -- customers (customer_id, name, registration_date) -- orders (order_id, customer_id, order_date, amount) SELECT DISTINCT c.customer_id, c.name FROM customers c LEFT JOIN orders o ON c.customer_id = o.customer_id and o.order_date >= DATE_TRUNC('month', CURRENT_DATE) - INTERVAL '1 month' WHERE o.amount IS NULL -- 2. Oblicz udział każdej podkategorii w łącznym przychodzie kategorii -- sales (product_id, category, subcategory, revenue, sale_date) -- Wynik: category | subcategory | share_of_category
Opowiedz o swoim doświadczeniu — czym zajmowałeś się na różnych projektach (konsulting, [organizacja], Econsoft, Beeline)?
-- 1. Wypisz klientów bez zamówień w ostatnim miesiącu. -- Struktura: -- customers (customer_id, name, registration_date) -- orders (order_id, customer_id, order_date, amount) SELECT DISTINCT c.customer_id, c.name FROM customers c LEFT JOIN orders o ON c.customer_id = o.customer_id and o.order_date >= DATE_TRUNC('month', CURRENT_DATE) - INTERVAL '1 month') WHERE o.amount IS NULL -- 2. Oblicz udział każdej podkategorii w łącznych przychodach kategorii -- sales (product_id, category, subcategory, revenue, sale_date) -- Wynik: category | subcategory | share_of_category
Opowiedz o konfiguracji CI/CD i konteneryzacji w Dockerze w projekcie — co dokładnie zrobiliście?
Czy samo ładowanie danych zostało napisane bezpośrednio w Pythonie?
Czy możesz opisać, jakie podejścia do projektowania architektury magazynów danych stosowałeś? Przynajmniej teoretycznie.
Czy pracowali Państwo nad jakością danych? Czy używali systemu weryfikacji?
Czy masz doświadczenie w optymalizacji w ClickHouse (w tym ładowanie danych)?
W zespole byli dwaj inżynierowie danych, którzy zajmowali się realizacją, a ty odpowiadałeś za architekturę i wymagania — zgadza się?
Jak dobrze znasz Data Vault, jego rodzaje obiektów (Hub, Link, Satellite) i podejście do projektowania?
Jaką rolę pełniłeś we wszystkich tych projektach: jako programista czy jako analityk ustalający wymagania dla programistów?