Kokius įrankius naudojo kūrimo metu?
System Analyst
Ar naudojote Kafka/RabbitMQ duomenų srautiniam apdorojimui projekte? Ką tiksliai darėte?
CV buvo paminėta Kafka — kas tai yra, ar ją naudojo?
Kokios pagrindinės duomenų kokybės patikros dažniausiai nustatytos?
-- 1. Išvardinkite klientus be užsakymų per paskutinį mėnesį. -- Struktūra: -- customers (customer_id, name, registration_date) -- orders (order_id, customer_id, order_date, amount) SELECT DISTINCT c.customer_id, c.name FROM customers c LEFT JOIN orders o ON c.customer_id = o.customer_id and o.order_date >= DATE_TRUNC('month', CURRENT_DATE) - INTERVAL '1 month') WHERE o.amount IS NULL -- 2. Apskaičiuokite kiekvienos pogrupio dalį bendroje kategorijos pajamose -- sales (product_id, category, subcategory, revenue, sale_date) -- Tikėtinas rezultatas: category | subcategory | share_of_category
Papaskinkite apie projektą [organizacija] dėl DWH ir beveik realaus laiko analitikos statybos objektų srityje: kokie uždaviniai buvo keliami, kaip jie buvo sprendžiami, kokie pasiekimai?
Papaskinkite apie savo patirtį — ką veikėte skirtinguose projektuose (konsultacijos, [organizacija], Econsoft, Beeline)?
-- 1. Išveskite klientų, neturinčių užsakymų per pastarą mėnesį, sąrašą. -- Struktūra: -- customers (customer_id, name, registration_date) -- orders (order_id, customer_id, order_date, amount) SELECT DISTINCT c.customer_id, c.name FROM customers c LEFT JOIN orders o ON c.customer_id = o.customer_id and o.order_date >= DATE_TRUNC('month', CURRENT_DATE) - INTERVAL '1 month' WHERE o.amount IS NULL -- 2. Apskaičiuokite kiekvienos subkategorijos dalį bendro kategorijos pelno. -- sales (product_id, category, subcategory, revenue, sale_date) -- Reikalingas rezultatas: category | subcategory | share_of_category
Papaskinkite apie CI/CD nustatymus ir konteinerizaciją Docker projekte — ką tiksliai darėte?
Ar duomenų įkėlimas buvo parašytas tiesiogiai Python?
Ar galite paaiškinti, kokius požiūrius naudojote duomenų saugyklų architektūros projektavimui? Bent jau teoriškai.
Komandoje buvo du duomenų inžinieriai, kurie užsiėmė įgyvendinimu, o jūs atsakėte už architektūrą ir reikalavimus — ar teisingai?
Ar turite patirties optimizacijoje ClickHouse (įskaitant duomenų įkėlimą)?
Kiek pažįstate Data Vault, jo objektų tipus (Hub, Link, Satellite) ir projektavimo požiūrį?
Ar dirbote su duomenų kokybe? Naudojote patikros sistemą?
Kokį vaidmenį atlikote visuose šiuose projektuose: kaip programuotojas ar kaip analitikas, nustatantis reikalavimus programuotojams?