Data Engineer
რომელი თვალთვალის ინსტრუმენტები გამოიყენეს? Spring Boot 2 და Spring Boot 3-ში?
ჩაწერილობების ჰეშების შედარების მეთოდი გამოიყენებოდა წყაროს და სამიზნე სარეგისტრაციოს შორის განსხვავების გამოთვლისთვის?
Oracle-დან Parquet (HDFS) მონაცემების არქივის პროცესის აღწერა ნაწილებად და მონაცემების აღდგენის საპირისპირო pipeline-ი. როგორ გადავჭრათ აღდგენილი მონაცემების მეორედ არქივის პრობლემა?
როგორ აწყობთ ჩვეულებრივ თქვენს სამუშაოს დავალებებზე და როგორ აკონტროლებთ პროგრესს?
რატომ გადაწყვიტეთ რეიტინგის გამოყოფა ცალკე CTE-ში? რატომ ვერ გამოიყენეთ იგი პირდაპირ პირველ CTE-ში?
LeetCode #? — PostgreSQL-ში არსებობს ცხრილი [ცხრილი] ერთ სვეტით id და მნიშვნელობებით 1, 1, 2. დაწერეთ DELETE სვეტი, რომელიც ფიზიკურად წაშლის ერთ დუბლიკატს.
რა პარამეტრებით ხართ გაცნობილი Distributed ძრავის in ClickHouse?
გაქვს გამოცდილება CI/CD-ში pipeline-ის კონფიგურაციაში, მაგალითად, GitLab?
SQL-ში WHERE და HAVING-ის შორის რა განსხვავებაა?
რა მოხდა და როგორ დავუბრუნოთ სამუშაო?
სტრიმინგის დროს, Iceberg მუშაობდა, გაგიგია? ეს ფაილების ნაგავდაცვაა.
რომელი სამუშაო ფორმატი უფრო მოსახერხებელია თქვენთვის — ოფისი, ჰიბრიდი ან დისტანციური? ჩვენ ორი ოფისი გვაქვს, კუტუზოვსკისსა და ტულაში.
რა განსხვავებაა Greenplum-სა და PostgreSQL-ს შორის?
გთხოვთ, მოგვიყევით მეტი მონაცემთა გადახრის შესახებ შარდებს შორის: როგორ განსაზღვრეს და როგორ გამოიყენეს შესაბამისი ფუნქცია/მექანიზმი?
გააზიარეთ თქვენი მონაცემების ხარისხის შესახებ გაგება — გაქვთ ამ სფეროში გამოცდილება?
რა მოხდება, თუ გამოიყენებთ `s ** 2` სიის `s = [1, 2, 3]`?
JOIN-ის ტიპები და მათი განსხვავებები
SQL-ში ძირითადი ოპერაციები რა წესით ხორციელდება: SELECT, FROM და ა.შ.?
სულ რამდენი ჩამოტვირთვა იყო — მაღალი დონის სამუშაოები, ძაფები?
როგორ ჩაიტანეს მონაცემები გარე ცხრილიდან სამიზნე ცხრილებში?