Data Engineer
გადახედეთ თუ მუშაობდით feature store-ებთან?
გაქვს გამოცდილება CI/CD-ში pipeline-ის კონფიგურაციაში, მაგალითად, GitLab?
SQL-ში WHERE და HAVING-ის შორის რა განსხვავებაა?
როგორ აღწერდი კოდში იმას, რომ მნიშვნელობა მნიშვნელოვნად განსხვავდება ნორმალური (მოლოდინით) განაწილებიდან?
რა მოხდა და როგორ დავუბრუნოთ სამუშაო?
სტრიმინგის დროს, Iceberg მუშაობდა, გაგიგია? ეს ფაილების ნაგავდაცვაა.
რომელი სამუშაო ფორმატი უფრო მოსახერხებელია თქვენთვის — ოფისი, ჰიბრიდი ან დისტანციური? ჩვენ ორი ოფისი გვაქვს, კუტუზოვსკისსა და ტულაში.
რა განსხვავებაა Greenplum-სა და PostgreSQL-ს შორის?
რა არის CROSS JOIN და რა არის მისი გამოყენების შედეგი?
როგორ გამოსწორდით მონაცემების გადახრა client_id-ის მიხედვით, როდესაც ერთი მომხმარებელი მნიშვნელოვნად მეტია დანარჩენებზე? რა ვარიანტები არსებობს?
რა გიბიძგებს მოგზაურობის სფეროში? შესაძლოა, თავად გიყვარს მოგზაურობა, ან travel-tech რამენაირად გატაცებს?
SQL-ში ძირითადი ოპერაციები რა წესით ხორციელდება: SELECT, FROM და ა.შ.?
როგორ გადავცეთ მონაცემები სამუშაოებს შორის Airflow-ში?
როგორ ჩაიტანეს მონაცემები გარე ცხრილიდან სამიზნე ცხრილებში?
რა იწვევს ახალი სამუშაოს შექმნას Spark-ში და როგორ იყოფა სამუშაო სტადიონებად და დავალებებად?
მოგიყევი შენზე: რა გითმევდი, რა ტექნოლოგიების სტეკი გამოიყენე და რა იყო ეს პროექტი?
რა არის მონაცემთა გამოფენა?
გაქვთ კითხვები გუნდისა და როლის შესახებ?
თქვენი lakehouse რომელ ტექნოლოგიებზეა აგებული და რა პრობლემები წარმოიქმნება Apache Iceberg-თან მუშაობისას?
გთხოვთ, მომიყევით თქვენი გამოცდილების შესახებ გასულ წელს: რა გუნდი, რა დავალებები, რა როლი და რა იყო ყველაზე საინტერესო დავალება.