რა ინსტრუმენტები გამოიყენეს განვითარების დროს?
System Analyst
პროექტში Kafka/RabbitMQ-ის გამოყენება მოხდა თუ არა? რა კონკრეტულად გააკეთეთ?
რა ძირითადი მონაცემთა ხარისხის შემოწმებები იყო ჩვეულებრივ კონფიგურირებული?
რეზიუმეში იყო მითითებული Kafka — ეს რა არის, გამოიყენეს თუ არა?
-- 1. ბოლო თვის განმავლობაში შეუკვეთავი მომხმარებლების სია. -- სტრუქტურა: -- customers (customer_id, name, registration_date) -- orders (order_id, customer_id, order_date, amount) SELECT DISTINCT c.customer_id, c.name FROM customers c LEFT JOIN orders o ON c.customer_id = o.customer_id and o.order_date >= DATE_TRUNC('month', CURRENT_DATE) - INTERVAL '1 month') WHERE o.amount IS NULL -- 2. გამოითვალეთ თითოეული ქვეგატეგორიის წილი საერთო შემოსავლებში -- sales (product_id, category, subcategory, revenue, sale_date) -- შედეგი: category | subcategory | share_of_category
[ორგანიზაციაში] DWH და ახლო რეალურ დროში ანალიტიკის პროექტის შესახებ ისაუბრეთ: რა ამოცანები იყო დასახული, როგორ გადაჭრეს, რა მიღწევები იყო?
თქვით თქვენი გამოცდილების შესახებ — რა საქმიანობა გქონდათ სხვადასხვა პროექტებზე (კონსალტინგი, [ორგანიზაცია], Econsoft, Beeline)?
-- 1. ბოლო თვის განმავლობაში შეუკვეთავი მომხმარებლების სია გამოიტანეთ. -- სტრუქტურა: -- customers (customer_id, name, registration_date) -- orders (order_id, customer_id, order_date, amount) SELECT DISTINCT c.customer_id, c.name FROM customers c LEFT JOIN orders o ON c.customer_id = o.customer_id and o.order_date >= DATE_TRUNC('month', CURRENT_DATE) - INTERVAL '1 month' WHERE o.amount IS NULL -- 2. გამოითვალეთ თითოეული ქვეგატეგორიის წილი საერთო შემოსავლებში -- sales (product_id, category, subcategory, revenue, sale_date) -- საჭირო შედეგი: category | subcategory | share_of_category
პროექტზე CI/CD-ის კონფიგურაცია და Docker-ში კონტეინერიზაცია — რა გააკეთეთ ზუსტად?
მონაცემების ჩატვირთვა პირდაპირ Python-ით დაწერილი იყო?
შეგიძლიათ ახსნათ, რა მიდგომებს იყენებდით მონაცემთა საცავების არქიტექტურის დიზაინში? მინიმუმ თეორიულად.
შეგიძლიათ თქვათ, რომ გაქვთ გამოცდილება ClickHouse-ში ოპტიმიზაციაში (მათ შორის მონაცემების ჩატვირთვა)?
გუნდაში ორი მონაცემთა ინჟინერი იყო, რომლებიც განხორციელებაზე იყვნენ დაკავებული, ხოლო თქვენ პასუხისმგებელი იყავით არქიტექტურასა და მოთხოვნებზე — სწორად?
რამდენად იცნობ Data Vault-ს, მისი ობიექტების ტიპებს (Hub, Link, Satellite) და პროექტის მიდგომას?
დამუშავებდით მონაცემების ხარისხზე? გამოიყენეთ შემოწმების სისტემა?
ამ ყველა პროექტში რა როლს ასრულებდით — როგორც პროგრამისტი თუ როგორც მოთხოვნების განსაზღვრავი ანალიტიკოსი?