საერთო ჯამში, რელაციური მონაცემთა ბაზების შესახებ ისაუბრე — ეს რა არის?
Data Engineer
რა არის ACID? რა ნიშნავს თითოეული ასო? როგორ უკავშირდება ეს ტრანზაქციებს?
იცნობ თუ არა Avro ფორმატს?
როდის არ გვჭირდება მონაცემთა შენახვა?
რა შეზღუდვები არსებობს ჰეშის სქემის გამოყენებაში?
შენ გაქვს გამოცდილება Docker-ის გამოსახულებებთან, ვირტუალურ მანქანაზე გარემოს შექმნასთან?
რა არის დაკის ტიპიზაცია (duck typing)?
თქვით Docker პროცესებზე, შეგიძლიათ უფრო დეტალურად ახსნათ, როგორ არის ეს თქვენი ორგანიზაციაში მოწყობილი?
როგორ არის ორგანიზებული თქვენი QA (მონაცემების ხარისხის შემოწმება)?
რეფაქტორინგსა და ოპტიმიზაციას შორის რა განსხვავებაა?
რა არის სარეკლამო გეგმა? რა მიზნით არის საჭირო?
შეიძლება მუშაობა Table Engine Join-თან ClickHouse-ში?
რა არ გსიამოვნებს ამჟამად შენს სამუშაოში?
რა ტიპის ფიზიკური კავშირებია (შერწყმის მეთოდები)?
შეგიძლიათ მითხრათ თქვენი გამოცდილების შესახებ განაწილებული მონაცემთა ბაზებთან (Greenplum, ClickHouse)?
დავუშვათ, Data Vault ხელმისაწვდომი არ არის და ორი ფართო ცხრილი უნდა შეერთოს. როგორ ოპტიმიზირებდით ამას Greenplum-ში? და თუ ეს ClickHouse-ში იყო?
შესაძლებელია რაიმე სხვა იფიქრო ჩვეულებრივი CTE-ს ნაცვლად, учитывая, რომ ფილტრი მაინც ხდება მეხსიერებაში მთელ სარედაქციო ცხრილზე?
სად დაიწყო Spark-ის გაშვება?
არის თუ არა გამოცდილება Trino-ის მსგავსი ძრავებთან ან Spark-ში ცხრილურ ფორმატებთან (Iceberg, Parquet)?
რატომ გჭირდებოდათ ზოგადად Data Vault?