მონაცემთა ბაზებში ინდექსები რა არის, რა მიზნით გამოიყენება და რა არის მათი შიდა სტრუქტურა?
Data Engineer
გააზიარე შენი სამუშაო გამოცდილება ბოლო ადგილებზე, რა პროექტები, რა სტეკი?
რა განსხვავებაა UNION და UNION ALL-ს შორის? რა პირობები უნდა შესრულდეს?
რომელი SQL ოპერატორების ჯგუფებს იცნობ? მათ რა მიეკუთვნება?
როგორ მუშაობს Hash Join?
Spark-ში Catalyst ოპტიმიზატორი რა არის და რა კონკრეტული ოპტიმიზაციებს ახორციელებს (მაგალითად, predicate pushdown)?
როგორ გადაამოწმებთ მონაცემების სიზუსტეს SAS-დან DBT-მდე ტრანსლაციისას?
რატომ წარმოიქმნება deadlock-ები და რა მექანიზმი პასუხისმგებელია მონაცემთა კონსისტენციისთვის პარალელური მოთხოვნების დროს?
დამატებითი მონაცემების ხარისხის შემთხვევებზე მუშაობდი?
რა არის ნორმალიზაცია? ძირითადად რომელ ფორმაზე ვმუშაობთ?
რატომ აირჩიეთ სწორედ DBT? რა უპირატესობებს და ნაკლოვანებებს ხედავთ ამ ჩარჩოში?
საფუძველზე, რა შემოწმებები ხორციელდება და რა ხდება არავალიდური მონაცემებთან მონაცემების ხარისხის (Data Quality) შემოწმების დროს?
Python-ში Set და List-ის თვისებები და განსხვავებები რა არის? შესრულების გარდა, რა სხვა თვისებები არსებობს?
გააზიარეთ საინტერესო დავალება კომპანიაში ბოლო 2,5 წლის განმავლობაში, მაგალითად, ClickHouse-თან დაკავშირებული.
Greenplum-ში რა განაწილების ფორმატებია, გარდა BY column და RANDOMLY-ის?
როგორ მუშაობს Merge Join (შერწყმა სორტირებით)?
სია SQL-ის შეკითხვის ოპერაციების შესრულების სერია, რომელიც იწყება SELECT, FROM, WHERE, GROUP BY, HAVING, ORDER BY, LIMIT, პირველი დან ბოლოამდე.
შენ უფრო გსურს მუშაობა როგორც ექსპერტი ინდივიდუალურად, თუ დეველოპერების გუნდში?
ჩვენს მომხმარებელთა ცხრილი გვაქვს (id, სახელი, მისამართი და ა.შ.), პროდუქტები (id, სახელი და ა.შ.), პროდუქტის მოძრაობა (აქ გვაქვს მომხმარებლის id, პროდუქტი, თარიღი, რაოდენობა, ჯამი), უნდა ვიპოვოთ რომელი პროდუქტები გაიყიდა 1 იანვარს, მხოლოდ უნიკალები და ასევე გამოვიტანოთ ყიდვის სახელიც და...
რა სახის ფიზიკური კავშირი არსებობს ცხრილებს შორის (Hash Join, Merge Join, Nested Loop)?