Oracle'daki sorgu optimize nasıl çalışır, neye bakar ve hangi sınıfa aittir?
Data Engineer
HDFS'de verileri bloklara ayırmanın amacı nedir?
Impala ile nasıl çalışıyordunuz?
HDFS, geleneksel dağıtılmış dosya sistemlerinden nasıl farklıdır?
MapReduce nasıl çalışır, özellikle Reduce aşaması?
YARN nedir ve ne işe yarar?
CI/CD ile nasıl çalıştınız?
S3'ten Greenplum'a verileri nasıl yüklediniz?
Spark'ta shuffle nedir ve neden minimize edilmesi önemlidir?
Oracle'da sorgu yürütme planını nasıl görebilirim? EXPLAIN PLAN ile EXPLAIN ANALYZE arasındaki fark nedir?
İşinizde PL/SQL prosedürlerinin kullanımını anlatın.
Spark'ta broadcast join nedir?
Spark görevlerinin optimizasyonu konusunda deneyiminiz var mı? Somut bir örnek verebilir misiniz?
Oracle'da paketler yazmak zorunda kaldınız mı?
Artımlı ve tam yükleme ile çalıştınız mı? Çiftleri nasıl başa çıkardınız?
Hive nedir ve geleneksel ilişkisel veritabanlarından nasıl ayrılır?
RANK ile DENSE_RANK arasındaki fark nedir?
Sütun tipi depolamanın satır tipi depolamaya göre avantajı nedir?
HDFS'den bir dosya, örneğin Parquet, nasıl okunur — tamamen mi yoksa bloklar halinde mi?
Oracle'da bölümlendirme hakkında bilgi verin: neden kullanılır ve hangi türleri vardır?