Data Engineer
SQL'de WHERE ve HAVING arasındaki fark nedir?
Ne oldu ve çalışmayı nasıl geri alırsın?
Greenplum ile PostgreSQL arasındaki fark nedir?
print(len(' '.join(map(str, [0, 1]))))
Sizin için iş görevleri ile altyapı görevleri arasındaki ideal oran nedir?
Bir müşterinin diğerlerinden önemli ölçüde büyük olduğu durumda client_id verilerindeki önyargıyı nasıl düzelttiniz? Hangi seçenekler var?
Seni seyahat alanında ne çekiyor? Belki de kendin seyahat etmeyi seviyorsun ya da travel-tech sana bir şekilde ilgi çekti.
Dış tablodaki veriler hedef tablolara nasıl yüklendi?
Veri vitrini nedir?
Data Vault erişilebilir değil ve iki geniş tabloyu birleştirmeniz gerekiyor varsayalım. Bunu Greenplum'ta nasıl optimize ederdiniz? Peki ya ClickHouse'ta olsaydı?
Resimde gösterilen yapıya sahip tablolar yapısı oluşturuldu. Resimde gösterilen sorguyu çalıştırmak gerekiyor. [...]'in yerine hangi join tipi kullanılmalı ki, sonuçta type = 'table_aw' olan kayıtlar için 'naming' sütunu doldurulsun ve type = 'table2' olan kayıtlar için 'serial_number' sütunu doldurulsun? create table multirelation( type varchar not null, entity_id integer not null ); create table table_aw( id integer primary key, naming varchar not null ); create table table2( id integer primary key, serial_number varchar not null ); -- tablo yapısı select m.type,m.entity_id, ta.naming, t2.serial_number from multirelation m [...] join table_aw ta on m.entity_id = ta.id and m.type='table_aw' [...] join table2 t2 on m.entity_id = t2.id and m.type='table2'; -- sorgu Boş bırakın inner cross right left
SQL'de iki tablo nasıl birleştirilir?
Moskova'dan mısın? Burada uzun süredir yaşıyor musun? Neden Moskova'ya taşındın?
Bana kendinizden bahsedin, nerede çalıştınız, ne yaptınız, ilginç görevler ve başarısızlıklar nelerdir?
Konumuz çok yapısal, ağaç şeklinde, veriler ham — bunları nasıl işleyebiliriz?
Monoton şekilde artan bir birincil anahtarla sürekli yeni kayıtlar gelen büyük PostgreSQL tablosunda ClickHouse'a veri yükleme nasıl organize edilir?
Bildikleriniz SQL pencere fonksiyonlarını listeleyin.
Birden fazla teklif varsa, seçim yaparken dikkate alınacak en önemli 3 kriter.
Data Science ve büyük veri işlemleriniz için Rust'ta yazılmış, çok iş parçacıklı ve çok hızlı olan böyle bir kütüphane biliyor musun? Pandas yerine kullanılabilir.
Spark JDBC nedir ve büyük bir tabloyu onun üzerinden verimli bir şekilde nasıl yükleriz?