SOAP API hakkında ne anlatabilirsin?
Data Engineer
DAG'leri nasıl başlattınız: cron, veri setleri, tetikleyiciler veya bağımlılıklar mı?
Data Vault'ta hangi veri kalitesi kontrolleri gerçekleştirildi?
OpenMetadata'ye nasıl bağlandınız ve onunla ne yaptınız?
Airflow'da DAG yazma ile ilgili tipik bir görevin örneğini ver.
Data Vault'ta belirli bir satırın hangi DAG çalışmasında göründüğünü nasıl takip edilir?
Greenplum'ta rastgele dağılım kullanılabilir mi ve ne zaman uygundur?
Tablolar ve sorguları nasıl optimize ettiniz: bölümler, indeksler, seçim mantığı?
Airflow'ı mı yönettiniz yoksa sadece geliştirici olarak mı çalıştınız?
Kendinizden bahsedin: neyle ilgilendiniz, hangi teknolojileri kullandınız ve bu ne tür bir projeydi?
Data Vault'ta Bridge ve PIT tablolarını kullandınız mı? Bir örnek verin ve amacını açıklayın.
Hangi SQL sorgularını yazıyorsun: basit kontroller mi yoksa karmaşık raporlama scriptleri mi?
Airflow günlükleri dışında ek günlükleme yapıldı mı?
Geri bildirimde bulunmak için ne zaman uygun ve elinde teklifler var mı?
Data Vault'ta hub, link ve satellite dışında hangi ek varlıklar kullanıldı: örneğin, same-as bağlantıları veya işlem bağlantıları?
S3 tek ana depolama mıydı yoksa birkaç tane mi kullanıldı?
Bildikleriniz SQL pencere fonksiyonlarını listeleyin.
Bir S3 kovası mı kullandınız yoksa birkaç mı? Hangi prensipte?
Kaynaktan tüketiciye kadar olan hatları oluşturdunuz mu?
Parquet'in depolama tipi nedir: satır mı yoksa sütun mu?