Data Engineer
დაწერე OpenMetadata-ის ინჯექციის პროცესები, რომლებიც წყაროებს სკანირებენ?
თუ შექმნით DAG, რომლის start_date-ი 2024 წლის 1 იანვარია, რა მოხდება?
შესაძლებელია რაიმე სხვა იფიქრო ჩვეულებრივი CTE-ს ნაცვლად, учитывая, რომ ფილტრი მაინც ხდება მეხსიერებაში მთელ სარედაქციო ცხრილზე?
ტერმინალში რომელ ძირითად Linux ბრძანებებს იყენებთ?
რა არის ტრანზაქციის ჟურნალი (WAL) მონაცემთა ბაზის მართვის სისტემაში და რა მიზნით გამოიყენება?
სად დაიწყო Spark-ის გაშვება?
რატომ გჭირდებოდათ ზოგადად Data Vault?
არის თუ არა გამოცდილება Trino-ის მსგავსი ძრავებთან ან Spark-ში ცხრილურ ფორმატებთან (Iceberg, Parquet)?
როგორ გამოცდილება გაქვთ SQL და რელაციური მონაცემთა ბაზებთან?
რატომ ეძებ ნოვი სამუშაო ადგილი და რა გსურთ მომავალში გაკეთება?
CREATE TABLE datamarts.daily_revenue_per_country ON CLUSTER cluster_4x2 ( event_date Date, country String, total_revenue Float64 ) ENGINE = MergeTree() PARTITION BY toYYYYMM(event_date) ORDER BY (event_date);
CI/CD პროცესები, მონაცემთა ბაზაში ცვლილებები, ვერსიების მართვა და სქემის მიგრაციები (სქემის ევოლუცია) შესახებ მომიყევი.
რა გიბიძგებს მოგზაურობის სფეროში? შესაძლოა, თავად გიყვარს მოგზაურობა, ან travel-tech რამენაირად გატაცებს?
Airflow-ის დავალებებს შორის მონაცემების გადაცემის რა მეთოდებს იცით?
მონაცემთა გაერთიანება რომელ ველებზე მოხდა და როგორ აღმოფხვრეს დუბლიკატები ვიტრინაში?
LeetCode #? — PostgreSQL-ში არსებობს ცხრილი [ცხრილი] ერთ სვეტით id და მნიშვნელობებით 1, 1, 2. დაწერეთ DELETE სვეტი, რომელიც ფიზიკურად წაშლის ერთ დუბლიკატს.
რა გესმით spill- ზე Spark-ში?
მიმდინარე სამუშაოში იყენებთ თუ არა ხელოვნურ ინტელექტს? რა ინსტრუმენტები და როგორ?
ბატჩის ჩატვირთვა ან სტრიმინგით მუშაობდი?
გვითხარით Python-ის ყველაზე მნიშვნელოვანი პროექტი ან დავალება გასული წლის განმავლობაში.