Data Engineer
İndekslerin en iyi kullanım uygulamaları hakkında bilgi verin - ne zaman ve ne sıklıkla kullanmalısınız.
Takım içinde genellikle Git ile nasıl çalışıyorsunuz? Ve Merge Request nedir?
Lojistik şirketi için rapor Bir lojistik şirketinde analistsiniz ve depolardaki operasyonları kaydediyorsunuz. Her depo verimliliği hakkında bir rapor hazırlamanız gerekiyor. Her depo için hesaplayın: • toplam operasyon sayısı (count_operations); • depoda işlenen toplam ürün sayısı (sum_quantity); • sadece belirtilen zamanla (NULL olmayan) işlemleri dikkate alarak ortalama işlem süresi (avg_processing_time), en yakın tam sayıya yuvarlanmış; • bir işlemde işlenen maksimum ve minimum ürün sayısı (max_quantity, min_quantity); • her işlem türü için ayrı sütunlarda: tedarik işlemleri (supply_operations), sevkiyat işlemleri (shipment_operations), transfer işlemleri (transfer_operations). Toplam işlem sayısı 2'den fazla olan ve ortalama işlem süresi 60 dakikayı aşmayan depoları filtreleyin. Sonucu depo ID'sine göre artan sırayla sıralayın. Giriş formatı operations tablosu: • operation_id (int) — işlem kimliği • warehouse_id (int) — depo kimliği • operation_type (text) — işlem türü: «tedarik», «sevkiyat», «transfer» • quantity (int) — işlemdeki ürün adedi • operation_date (timestamp) — işlem tarihi ve saati • processing_time (int) — işlem süresi processing_time sütunu NULL değerler içerebilir. Çıkış formatı Sorgu, aşağıdaki sırayla alanlar içeren bir tablo döndürmelidir: • warehouse_id (int) — depo kimliği • count_operations (int) — depoda gerçekleştirilen toplam işlem sayısı • sum_quantity (int) — depoda işlenen toplam ürün sayısı • avg_processing_time (numeric) — işlem süresinin ortalaması (dakika cinsinden), sadece NULL olmayan işlemler dikkate alınarak, en yakın tam sayıya yuvarlanmış • max_quantity (int) — bir işlemde işlenen maksimum ürün sayısı • min_quantity (int) — bir işlemde işlenen minimum ürün sayısı • supply_operations (int) — «tedarik» türündeki işlem sayısı • shipment_operations (int) — «sevkiyat» türündeki işlem sayısı • transfer_operations (int) — «transfer» türündeki işlem sayısı
Geri bildirimde bulunmak için ne zaman uygun ve elinde teklifler var mı?
Sadece çift sayılar üreten özel bir dizin olan even_sequence oluşturuldu. [...]'ın yerine ne konmalı ki, even_column değeri eklenirken belirtilmemişse, değer even_sequence'ten alınsın? create table some_table( even_column [...] ); integer computed as nextval('even_sequence') integer generated always as identity (start with 2 increment by 2) integer default nextval('even_sequence') integer unique default nextval('even_sequence') integer generated by even_sequence’
Tablolar ve sorguları nasıl optimize ettiniz: bölümler, indeksler, seçim mantığı?
Greenplum'ta verileri hangi alanlara dağıttın?
Data Vault'ta hangi veri kalitesi kontrolleri gerçekleştirildi?
Data Vault'ta Bridge ve PIT tablolarını kullandınız mı? Bir örnek verin ve amacını açıklayın.
ClickHouse'ta Table Engine Join ile çalışma deneyiminiz var mı?
Genellikle görevleriniz üzerinde nasıl organize ediyorsunuz ve ilerlemeyi nasıl takip ediyorsunuz?
SQL'de temel işlemler hangi sırayla gerçekleştirilir: SELECT, FROM vb.?
Airflow'da görevler arasında nasıl veri aktarılır?
Greenplum'ta, normal MySQL ve diğer diyalektilerde olmayan fonksiyonlar ve özellikler var mı?
Takım için süreçleri veya araçları geliştirmeyi başardığınız bir örnek veriniz.
Resimde gösterilen yapıya sahip tablolar yapısı oluşturuldu. Resimde gösterilen sorguyu çalıştırmak gerekiyor. [...]'in yerine hangi join tipi kullanılmalı ki, sonuçta type = 'table_aw' olan kayıtlar için 'naming' sütunu doldurulsun ve type = 'table2' olan kayıtlar için 'serial_number' sütunu doldurulsun? create table multirelation( type varchar not null, entity_id integer not null ); create table table_aw( id integer primary key, naming varchar not null ); create table table2( id integer primary key, serial_number varchar not null ); -- tablo yapısı select m.type,m.entity_id, ta.naming, t2.serial_number from multirelation m [...] join table_aw ta on m.entity_id = ta.id and m.type='table_aw' [...] join table2 t2 on m.entity_id = t2.id and m.type='table2'; -- sorgu Boş bırakın inner cross right left
Veri tüketicileri kimlerdi ve vitrinler nasıl oluşturuluyordu?
Ne oldu ve çalışmayı nasıl geri alırsın?
Konumuz çok yapısal, ağaç şeklinde, veriler ham — bunları nasıl işleyebiliriz?
Greenplum ile PostgreSQL arasındaki fark nedir?