Genel olarak ilişkisel veritabanlarından bahset — bunlar nedir?
Data Engineer
ACID nedir? Her harfinin anlamı nedir? Bu, işlemlerle nasıl ilgilidir?
Avro formatını biliyor musun?
Ne zaman veri depolamaya ihtiyacımız yok?
Hash tablosu kullanımında hangi sınırlamalar vardır?
Docker imajlarıyla, sanal makinede ortam kurma konusunda deneyimin oldu mu?
Duck typing nedir?
Docker süreçlerinden bahsettin, bu sizin organizasyonunuzda nasıl düzenlenmiş detaylı anlatabilir misin?
Veri kalitesi (veri doğrulama) nasıl düzenlenmiştir?
Refaktörleme ile optimizasyon arasındaki fark nedir?
Sorgu planı nedir? Ne işe yararlar?
ClickHouse'ta Table Engine Join ile çalışma deneyiminiz var mı?
Şu anda işinde beğenmediğin nedir?
Fiziksel bağlantı türleri (birleştirme yöntemleri) nelerdir?
Dağıtık veritabanları (Greenplum, ClickHouse) ile çalışma deneyiminizden bahsedebilir misiniz?
Data Vault erişilebilir değil ve iki geniş tabloyu birleştirmeniz gerekiyor varsayalım. Bunu Greenplum'ta nasıl optimize ederdiniz? Peki ya ClickHouse'ta olsaydı?
Normal CTE yerine başka bir şey düşünülebilir mi, çünkü filtreleme hala tüm tabloda bellekte gerçekleşiyor?
Spark hangi ortamda çalıştırıldı?
Trino gibi motorlar veya Spark'ta tablo formatları (Iceberg, Parquet) ile çalışma deneyiminiz var mı?
Genel olarak Data Vault'a neden ihtiyacınız vardı?