Aké nástroje sa používali pri vývoji?
System Analyst
Použili ste Kafka/RabbitMQ na spracovanie dát v prúde v projekte? Čo presne ste robili?
Aké základné kontroly kvality údajov sa zvyčajne nastavovali?
V životopise bola uvedená Kafka — čo je to, používali ju?
-- 1. Vypíšte zoznam zákazníkov bez objednávok za posledný mesiac. -- Štruktúra: -- customers (customer_id, name, registration_date) -- orders (order_id, customer_id, order_date, amount) SELECT DISTINCT c.customer_id, c.name FROM customers c LEFT JOIN orders o ON c.customer_id = o.customer_id and o.order_date >= DATE_TRUNC('month', CURRENT_DATE) - INTERVAL '1 month') WHERE o.amount IS NULL -- 2. Vypočítajte podiel každej podkategórie na celkovom výnose kategórie -- sales (product_id, category, subcategory, revenue, sale_date) -- Očakávaný výsledok: category | subcategory | share_of_category
Povedajte o projekte v [organizacija] za razvoj DWH in near real-time analitiko gradbenih objektov: katere naloge so bile, kako so bile rešene, kakšni dosežki?
-- 1. Vypíšte zoznam zákazníkov bez objednávok za posledný mesiac. -- Štruktúra: -- customers (customer_id, name, registration_date) -- orders (order_id, customer_id, order_date, amount) SELECT DISTINCT c.customer_id, c.name FROM customers c LEFT JOIN orders o ON c.customer_id = o.customer_id and o.order_date >= DATE_TRUNC('month', CURRENT_DATE) - INTERVAL '1 month' WHERE o.amount IS NULL -- 2. Vypočítajte podiel každej podkategórie na celkovom výnose kategórie -- sales (product_id, category, subcategory, revenue, sale_date) -- Požadovaný výsledok: category | subcategory | share_of_category
Porozprávajte o svojich skúsenostiach — čím ste sa zaoberali na rôznych projektoch (poradenstvo, [organizácia], Econsoft, Beeline)?
Povedajte mi o nastavitvi CI/CD in kontejnerizaciji v Docker na projektu — kaj ste točno naredili?
Bolo načítanie údajov napísané priamo v Pythone?
Môžete vysvetliť, aké prístupy ste použili pri navrhovaní architektúry dátových skladov? Aspoň teoreticky.
Máte skúsenosti s optimalizáciou v ClickHouse (vrátane načítania údajov)?
V tíme boli dvaja dátoví inžinieri, ktorí sa zaoberali implementáciou, a vy ste boli zodpovední za architektúru a požiadavky — správne?
Ako dobre ste oboznámení s Data Vault — s typmi objektov (Hub, Link, Satellite) a prístupom k navrhovaniu?
Pracovali ste na kvalite údajov? Používali ste systém kontroly?
Akú úlohu ste v týchto projektoch zastávali – ako vývojár alebo ako analytik stanovujúci požiadavky pre vývojárov?