Ce instrumente au fost folosite în timpul dezvoltării?
System Analyst
Ați folosit Kafka/RabbitMQ pentru procesarea datelor în flux în proiect? Ce anume ați făcut exact?
În CV a fost menționată Kafka — ce este asta, a fost folosită?
Ce verificări de bază ale calității datelor erau de obicei configurate?
Povesti despre proiectul din [organizație] pentru dezvoltarea DWH și analiza aproape în timp real a obiectivelor de construcție: ce sarcini au fost, cum au fost rezolvate, ce realizări s-au obținut?
-- 1. Afișați lista clienților fără comenzi în ultima lună. -- Structură: -- customers (customer_id, name, registration_date) -- orders (order_id, customer_id, order_date, amount) SELECT DISTINCT c.customer_id, c.name FROM customers c LEFT JOIN orders o ON c.customer_id = o.customer_id and o.order_date >= DATE_TRUNC('month', CURRENT_DATE) - INTERVAL '1 month' WHERE o.amount IS NULL -- 2. Calculați ponderea fiecărei subcategorii în venitul total al categoriei -- sales (product_id, category, subcategory, revenue, sale_date) -- Rezultat dorit: category | subcategory | share_of_category
Vorbiți despre experiența dvs. — cu ce v-ați ocupat în diferite proiecte (consultanță, [organizație], Econsoft, Beeline)?
-- 1. Lista clienților fără comenzi în ultimele lună. -- Structură: -- customers (customer_id, name, registration_date) -- orders (order_id, customer_id, order_date, amount) SELECT DISTINCT c.customer_id, c.name FROM customers c LEFT JOIN orders o ON c.customer_id = o.customer_id and o.order_date >= DATE_TRUNC('month', CURRENT_DATE) - INTERVAL '1 month') WHERE o.amount IS NULL -- 2. Calculați proporția fiecărei subcategorii în venitul total al categoriei -- sales (product_id, category, subcategory, revenue, sale_date) -- Rezultat așteptat: category | subcategory | share_of_category
Vorbește-mi despre configurarea CI/CD și containerizarea în Docker pe proiect — ce ai făcut exact?
Încărcarea datelor în sine a fost scrisă direct în Python?
Puteți explica ce abordări de proiectare a arhitecturii depozitelor de date ați folosit? Cel puțin teoretic.
Aveți experiență în optimizarea în ClickHouse (inclusiv încărcarea datelor)?
Echipa avea doi ingineri de date care se ocupau de implementare, iar tu erai responsabil pentru arhitectură și cerințe — corect?
Ați lucrat cu calitatea datelor? Ați folosit un sistem de verificare?
Cât de familiarizat sunteți cu Data Vault — cu tipurile de obiecte (Hub, Link, Satellite) și abordarea de proiectare?
Ce rol ați avut în toate aceste proiecte: ca dezvoltator sau ca analist care stabilește cerințele pentru dezvoltatori?