Data Engineer
ClickHouse-ში როგორ განსხვავდება მონაცემთა ტიპები int და uint?
როგორ მოქმედებს მარცვლების ზომა ClickHouse-ის სქემაზე?
როგორ დავწეროთ JSON ფოლდერში (Airflow DAG-ის კონტექსტში)
გააზიარეთ Kafka-ს ძირითადი კონცეფციები (მომხმარებელთა ჯგუფი, განყოფილებები, თემები).
[სახელი] მოგვიყევი ცოტა ჩვენი დავალებებთან დაკავშირებით შენი გამოცდილების შესახებ, რომელსაც ჩვენ ვცდილობდით აღწეროთ სამუშაო განცხადებაში.
რა არის დაკის ტიპიზაცია (duck typing)?
ჩვენ JSON-ს დავალაგებთ — ვინ გააკეთებს JSON-ის ანალიზს? ჩემი ცოდნით, ClickHouse-ში ფუნქციები არ არის.
რა არის Oracle-ში ჩვენებები (VIEW) და მატერიალიზებული ჩვენებები (MATERIALIZED VIEW)? როგორ განახლდება მატერიალიზებული ჩვენების მონაცემები?
რა არის LEFT SEMI JOIN და LEFT ANTI JOIN Spark SQL-ში, იყენებდით ოდესმე?
JSON-ს მესამე ნორმალურ ფორმაში გაყოფა: როგორ ინახავდით CashBreakdown-ის სიის და როგორ გენერირებდით სუროგატ გასაღებებს?
რა გსურთ განვითარება? კონკრეტული არქიტექტურული გადაწყვეტილებები?
რა არის broadcast join Spark-ში?
რომელი გამოთქმა [...] ადგილზე ავტომატურად გამოიწვევს ინდექსის შექმნას? მობილური პლატფორმაზე კოდის ჰორიზონტალური სლაიდი არსებობს create table some_table( col_name [...] ); unique references other_table(col_name) not null serial integer check (col_name > 0)
გვითხარით თქვენი სამუშაოში PL/SQL-პროედურების გამოყენების შესახებ.
სპეციალური თანმიმდევრობა შექმნილია სახელწოდებით even_sequence, რომელიც მხოლოდ ჯამებს ქმნის. რა უნდა ჩასვათ [...]-ის ადგილზე, რათა თუ even_column-ის მნიშვნელობა არ არის მითითებული შეტანაზე, მნიშვნელობა მიიღოს even_sequence-დან? create table some_table( even_column [...] ); integer computed as nextval('even_sequence') integer generated always as identity (start with 2 increment by 2) integer default nextval('even_sequence') integer unique default nextval('even_sequence') integer generated by even_sequence’
გქონია ოდესმე საჭიროება ანგარიშების, დაფების, ვიზუალიზაციების (BI) შექმნის?
რა არის shuffle-ის საფრთხე Spark-ში?
ერთი S3 ბაკეტი გამოიყენეთ თუ რამდენიმე? რა პრინციპით?
რა არის მონაცემთა განაწილება და როგორ ეხმარება ის სავსე სია სკანირებას?
გიტის ძირითადი საცავის ისტორიაში არსებობს კომიტები, რომლებიც შეიცავენ კრიტიკულად მნიშვნელოვანი საიდუმლო მონაცემებს. ამ მონაცემების სრული ამოღება უნდა მოხდეს მთელი ისტორიისგან. შეაფასეთ, რამდენად სწორია და უსაფრთხოა შემდეგი სტრატეგიის გამოყენება: შექმენით ახალი კომიტი, რომელიც ამოიღებს საიდუმლო მონაცემებს მიმდინარე ფაილების ვერსიიდან და გამოაგზავნეთ მას main-ზე. - სწორია, მაგრამ არა ოპტიმალური. უკეთესია, გამოიყენოთ git revert კომიტების გასაფართოებლად - პირობითად სწორია. ეს დროებითი გადაწყვეტილებაა, სანამ არ იპოვით უფრო რადიკალურ საშუალებას მონაცემების ამოსაღებად - არასწორია და არასაიმედოა. მონაცემები ამოიღება მიმდინარე ვერსიიდან, მაგრამ დარჩება ხელმისაწვდომი ისტორიის განმავლობაში - არასწორია. ეს კომიტი შეიძლება გამოიწვიოს ახალი კონფლიქტები სხვა ფილიალებთან შერწყმის დროს - სწორია და უსაფრთხოა. ეს მეთოდი უზრუნველყოფს, რომ მონაცემები ამოიღება და აღარ გამოჩნდება რეპოზიტორიაში