API-ს გარდა, რა სხვა მეთოდებს და პროტოკოლებს იყენებდით მონაცემთა წყაროებთან მუშაობისთვის?
Data Engineer
დაწერე OpenMetadata-ის ინჯექციის პროცესები, რომლებიც წყაროებს სკანირებენ?
Parquet-ში რა წესია ან რა ტიპის სიღრმე გამოიყენება?
როგორ მუშაობდნენ 1C-თან: მონაცემებს პირდაპირ მონაცემთა ბაზიდან იღებდნენ, თუ სხვა გზით, მაგალითად, ბუსით?
რა ხდებოდა, როდესაც მონაცემების ხარისხის შეზღუდვა აქტიურდებოდა: გაფრთხილება, ჩამოვარდნა, გადატვირთვა?
რატომ გამოიყენეს Parquet-ის ნაცვლად ORC?
რატომ არის S3-ში "ფოლდერები"/პრეიფიქსები საჭირო, გარდა კომფორტისა?
რა ტექნიკური ველები გამოიყენეს satellites, links და hubs Data Vault-ში?
S3-ში ცხრილის სახის შედეგებს პარექით ან სხვა გზით ინახავდით?
პორტალით ფაილების ან მონაცემების მიღებისთვის FTP-თან მუშაობდით?
თქვით S3-ის ბაკეტებზე ან ობიექტებზე ტეგების კონფიგურაცია?
როგორ განსაზღვრეთ, რომ ჩანაწერი უკვე არსებობს და მისი ხელახლა ჩაწერა საჭირო არ არის?
რომელ ფაილურ ფორმატებთან მუშაობდით?