რა შეგიძლია თქვა SOAP API-ს შესახებ?
Data Engineer
როგორ დაიწყეთ DAG-ები: cron, მონაცემთა ნაკადები, ტრიგერები ან დამოკიდებულებები?
რა მონაცემთა ხარისხის შემოწმებები ჩატარდა Data Vault-ში?
როგორ მიერთდით OpenMetadata-ს და რა გააკეთეთ მასთან?
როგორ გამოვიკვლიოთ, რომელ DAG-ის გაშვების დროს გამოჩნდა კონკრეტული სვეტი Data Vault-ში?
მოყევით Airflow-ში DAG-ის დაწერის ტიპური დავალების მაგალითი.
Airflow-ს მართავდით თუ მხოლოდ დეველოპერად მუშაობდით?
როგორ ოპტიმიზირდნენ ცხრილები და შეკითხვები: ნაწილები, ინდექსები, არჩევანის ლოგიკა?
მოგიყევი შენზე: რა გითმევდი, რა ტექნოლოგიების სტეკი გამოიყენე და რა იყო ეს პროექტი?
შესაძლებელია Greenplum-ში შემთხვევითი განაწილების გამოყენება და როდის არის ეს შესაბამისი?
რომელ SQL შეკითხვებს წერ: მარტივი შემოწმებები თუ რთული სკრიპტები ვიტრინებისთვის?
Airflow-ის ლოგების გარდა დამატებითი ლოგირება განხორციელდა?
როდის შეგიძლია მისცე გამოხმაურება და გაქვს შეთავაზებები ხელში?
Data Vault-ში Bridge და PIT ცხრილებს იყენებდით? მიცით მაგალითი და ახსენით მათი დანიშნულება.
Data Vault-ის დამატებითი ერთეულები, მაგალითად, same-as links ან transactional links, გამოიყენებოდა?
S3 იყო ერთადერთი ძირითადი საცავი თუ რამდენიმე გამოიყენეთ?
სია SQL ფანჯრის ფუნქციები, რომლებიც იცით.
ერთი S3 ბაკეტი გამოიყენეთ თუ რამდენიმე? რა პრინციპით?
შექმენით წყაროდან მომხმარებელამდე ხაზის სია?
Parquet-ის შენახვის ტიპი რა არის: ხაზი თუ სვეტი?