კაფკასთან მუშაობდით?
Data Engineer
მოგიყევი ზოგადად შენი გამოცდილებისა და რა ისწავლე.
რატომ გადაწყვიტე შენი მიმდინარე პროექტის დატოვება? რა არ მოგწონს იქ?
Hive როგორ განსხვავდება Impala-დან?
რატომ ტოვებთ თქვენს მიმდინარე სამუშაოს?
შენ გაქვს თუ არა ad-hoc დავალებები მკაფიო ტექნიკური დავალების მიუხედავად, და როგორ უყურებ ad-hoc მოთხოვნებს და პრიორიტეტების ცვლილებებს?
რა არის თქვენი მოლოდინები ახალი პროექტის მიმართ?
შენ შექმენი დashboard-ებს და მუშაობდი მონაცემთა ვიზუალიზაციის ინსტრუმენტებთან (BI ინსტრუმენტები)?
OLAP კუბების გაცნობა გაქვს? როდესაც ჩვენ ვმუშაობთ მრავალმხრივ მონაცემებთან, რომლებიც მსგავსია Excel-ის პივოტის მაგიდის, მაგრამ უფრო სწრაფი ურთიერთქმედებისთვის დიდი მოცულობის მონაცემებთან.
Greenplum-ში არსებობს თუ არა ფუნქციები და შესაძლებლობები, რომლებიც ჩვეულებრივ MySQL-ში და სხვა დიალექტებში არ არის?
PostgreSQL-ში რა გითვალისწინებთ ჩვეულებრივ? შექმენით ინდექსები და რა კიდევ გააკეთეთ მონაცემთა ბაზაში?
როგორ გამოიყენეთ Hadoop/HDFS/Hive?
PostgreSQL-ში VACUUM და VACUUM FULL-ის განსხვავება რა არის?
ჩვენ გვაქვს ORDER BY რაოდენობის მიხედვით, და ორი შეკვეთა 5-ია, კიდევ ორი 3-ია. როგორ მოიქცევიან RANK() და DENSE_RANK()?
როგორ განხორციელდა პერსონალიზებული Airflow ოპერატორი: BashOperator-ის საშუალებით?
რა შემთხვევებში არის Nested Loop Join ყველაზე შესაფერისი?
SQL-ში ძირითადი ოპერაციები რა წესით ხორციელდება: SELECT, FROM და ა.შ.?
ამჟამად ინტერვიუებზე ხართ? გაქვთ შეთავაზებები ან ხართ საბოლოო ეტაპებზე, განსაკუთრებით ბანკებში?
გქონდათ თუ არა კონფლიქტები გუნდში ან მენეჯერთან? როგორ გაუმკლავდით ამას? მაგალითები მიაწოდეთ.
გვითხარით Spark-ის სამუშაოებზე: რა დაწერეთ, რა აბსტრაქციებს და ოპერაციებს გამოიყენეთ?