Data Engineer
Satır ve sütun tabanlı veritabanlarının avantajları ve dezavantajları nelerdir? Hangisi gruplama ve toplama için daha etkilidir?
Mikroservis mimarisi tasarımı görevi: Üç ayrı mikroservis varken, frontend'e sipariş tablosu (ürünler, fiyatlar, siparişler) için nasıl veri sağlanır?
Sütun tipi depolamanın satır tipi depolamaya göre avantajı nedir?
Dinamik tipleme nedir?
dbt'de hangi artımlı yükleme stratejilerini kullandınız?
Veri geçmişi saklama yöntemleri (türleri) nelerdir? Tablolarda tarih nasıl birikir?
Apache Airflow için basit bir DAG yazın
Domain Driven Design (DDD) metodolojisiyle tanışıyor musunuz? Eğer evet ise, projelerinizdeki uygulama örneklerini paylaşın.
Python'da 100 gigabaytlık bir dosyayı nasıl okuyabilirsiniz?
Yukarı doğru uzatma nasıl yapılır (NULL'leri ters yönde önceki null olmayan değerle doldurun)?
Iceberg formatı, geleneksel Parquet'e göre ne getiriyor?
Greenplum'ta BY column ve RANDOMLY dışında hangi dağıtım formatları var?
Hangi fiziksel JOIN'leri biliyorsun?
OLAP küpleriyle tanışıyor musun? Çok boyutlu verilerle çalışırken, Excel'deki özet tabloya benzeyen, ancak büyük veri hacimleriyle daha hızlı etkileşim sağlayan yapılar.
Artımlı ve tam yükleme ile çalıştınız mı? Çiftleri nasıl başa çıkardınız?
CTE ile alt sorgu arasındaki fark nedir?
Greenplum hakkında bana anlat — veri depolama formatları, satır ve sütun depolama.
Git Flow yeni uygulama sürümünü nasıl önerir? - Yeni bir issue dalı oluşturarak - master'dan hotfix dalı oluşturarak - develop'ten ayrı bir release dalı oluşturarak - doğrudan master dalına commit yaparak - master dalını doğrudan develop ile birleştirerek
ClickHouse'da hangi tablo motorlarını biliyor ve kullandınız?
SEÇİL * TABLO1'den AL t1 TABLO2'yi SOL JOIN ile t2 olarak ekle ON t1.date_start > t2.date_start --DML EĞER YOKSA Employee TABLOSU OLUŞTUR (id int, salary int, departmentId int); Employee Tablosuna Ekle (id,salary,departmentId) DEĞERLERİ (1, 70000, 1),(2, 94000, 1),(3, 85000, 1),(4, 80000, 2),(5, 60000, 2),(6, 62000, 3),(7, 90000, 3),(8, 94000, 3),(9, 94000, 3); cte ile as( seç *, rank() over(partition by departmentId order by salary desc) olarak max_salary Employee'den ) select * from cte where max_salary = 1