Avro formatını biliyor musun?
Data Engineer
Genel olarak ilişkisel veritabanlarından bahset — bunlar nedir?
ACID nedir? Her harfinin anlamı nedir? Bu, işlemlerle nasıl ilgilidir?
Ne zaman veri depolamaya ihtiyacımız yok?
Docker süreçlerinden bahsettin, bu sizin organizasyonunuzda nasıl düzenlenmiş detaylı anlatabilir misin?
Duck typing nedir?
Docker imajlarıyla, sanal makinede ortam kurma konusunda deneyimin oldu mu?
Hash tablosu kullanımında hangi sınırlamalar vardır?
Veri kalitesi (veri doğrulama) nasıl düzenlenmiştir?
Fiziksel bağlantı türleri (birleştirme yöntemleri) nelerdir?
Refaktörleme ile optimizasyon arasındaki fark nedir?
Sorgu planı nedir? Ne işe yararlar?
ClickHouse'ta Table Engine Join ile çalışma deneyiminiz var mı?
Dağıtık veritabanları (Greenplum, ClickHouse) ile çalışma deneyiminizden bahsedebilir misiniz?
Data Vault erişilebilir değil ve iki geniş tabloyu birleştirmeniz gerekiyor varsayalım. Bunu Greenplum'ta nasıl optimize ederdiniz? Peki ya ClickHouse'ta olsaydı?
Trino gibi motorlar veya Spark'ta tablo formatları (Iceberg, Parquet) ile çalışma deneyiminiz var mı?
Şu anda işinde beğenmediğin nedir?
Normal CTE yerine başka bir şey düşünülebilir mi, çünkü filtreleme hala tüm tabloda bellekte gerçekleşiyor?
Spark hangi ortamda çalıştırıldı?
Genel olarak Data Vault'a neden ihtiyacınız vardı?