Welke tools werden gebruikt tijdens de ontwikkeling?
System Analyst
Heeft u Kafka/RabbitMQ gebruikt voor streamverwerking van gegevens in het project? Wat deed u precies?
In het cv werd Kafka genoemd — wat is dat, is het gebruikt?
Welke basiscontroles voor datakwaliteit werden gewoonlijk ingesteld?
-- 1. Maak een lijst van klanten zonder bestellingen in de afgelopen maand. -- Structuur: -- customers (customer_id, name, registration_date) -- orders (order_id, customer_id, order_date, amount) SELECT DISTINCT c.customer_id, c.name FROM customers c LEFT JOIN orders o ON c.customer_id = o.customer_id and o.order_date >= DATE_TRUNC('month', CURRENT_DATE) - INTERVAL '1 month') WHERE o.amount IS NULL -- 2. Bereken het aandeel van elke subcategorie in de totale omzet van de categorie -- sales (product_id, category, subcategory, revenue, sale_date) -- Verwachte resultaat: category | subcategory | share_of_category
Vertel over het project bij [organisatie] voor de ontwikkeling van DWH en near real-time analyse van bouwprojecten: welke taken stonden er, hoe werden ze opgelost, welke prestaties zijn er geleverd?
Vertel over je ervaring — waarmee je hebt gewerkt aan verschillende projecten (advies, [organisatie], Econsoft, Beeline)?
-- 1. Maak een lijst van klanten zonder bestellingen in de afgelopen maand. -- Structuur: -- customers (customer_id, name, registration_date) -- orders (order_id, customer_id, order_date, amount) SELECT DISTINCT c.customer_id, c.name FROM customers c LEFT JOIN orders o ON c.customer_id = o.customer_id and o.order_date >= DATE_TRUNC('month', CURRENT_DATE) - INTERVAL '1 month' WHERE o.amount IS NULL -- 2. Bereken het aandeel van elke subcategorie in de totale omzet van de categorie -- sales (product_id, category, subcategory, revenue, sale_date) -- Gewenst resultaat: category | subcategory | share_of_category
Vertel me over de CI/CD-instellingen en containerisatie in Docker op het project — wat heb je precies gedaan?
Was het dataloaden zelf rechtstreeks in Python geschreven?
Kunt u uitleggen welke benaderingen voor het ontwerpen van datawarehouse-architecturen u hebt gebruikt? Althans theoretisch.
Heeft u ervaring met optimalisatie in ClickHouse (inclusief gegevensladen)?
Er waren twee data-engineers in het team die verantwoordelijk waren voor de implementatie, en jij was verantwoordelijk voor de architectuur en de vereisten — klopt dat?
Hoe vertrouwd bent u met Data Vault — met de soorten objecten (Hub, Link, Satellite) en de ontwerpbenadering?
Hebben jullie gewerkt aan de kwaliteit van de gegevens? Hebben jullie een verificatiesysteem gebruikt?
Welke rol heb je in al deze projecten vervuld: als ontwikkelaar of als analist die de vereisten voor ontwikkelaars opstelt?