Šta možeš da kažeš o SOAP API?
Data Engineer
Kako ste pokretali DAG-ove: putem cron-a, skupova podataka, okidača ili zavisnosti?
Koje provere kvaliteta podataka su obavljene u Data Vault?
Kako su se povezali na OpenMetadata i šta su radili s njom?
Kako pratiti u kojem pokretanju DAG-a se pojavila određena linija u Data Vault?
Navedite primer tipičnog zadatka za pisanje DAG u Airflow.
Da li ste administrirali Airflow ili ste radili samo kao programer?
Kako su optimizovane tabele i upiti: particije, indeksi, logika izbora?
Ispričaj o sebi: čime si se bavio, koji si skup tehnologija koristio i kakav je to bio projekat?
Koje SQL upite pišeš: jednostavne provere ili složeni skripti za vitrine?
Da li ste vršili dodatno logovanje osim Airflow logova?
Kada možeš dati povratne informacije i imaš li ponude na ruci?
Da li je moguće koristiti slučajnu distribuciju u Greenplum i kada je to prikladno?
Da li ste koristili Bridge i PIT tabele u Data Vault-u? Dajte primer i objasnite svrhu.
Koje dodatne entitete Data Vault, pored hub, link i satellite, su korišćene: na primer, same-as links ili transactional links?
Da li je S3 bio jedino glavno skladište ili ste koristili više?
Navedite poznate vam SQL funkcije prozora.
Da li ste koristili jedan S3 bucket ili više? Po kojem principu?
Da li ste izgradili lanac od izvora do potrošača?
Koji tip skladištenja ima Parquet: red ili kolona?