Greenplum'taki materyalize görünümden ClickHouse'a verileri nasıl aktarabilirsiniz?
Data Engineer
Dört kişilik bir ekipte rolün neydi ve 3-4 yıl içinde kariyerini nasıl görüyorsun, hangi hedefleri koyuyorsun?
Toplam kaç indirme vardı — üst düzey işler, iş parçacıkları?
Python hakkında ne kadar bilginiz var?
Girişte meta verileri sağlıyoruz ve bu, bu meta verilere dayanarak bir akış oluşturuyor — bu, mevcut akışların eski sistemlerden planlanana hızlı bir şekilde nasıl taşınmasını sağlar?
Analitik fonksiyonlar (pencere fonksiyonları) ile nasıl çalışıyordu?
CTE'de çok bellek kullanımı oluyor — bellek kullanımı yüksek olduğunda, verilerle ne olur?
Büyük depolama — hacimlerde ve nesnelerde manuel olarak sürdürmek ne kadar zordu?
Sorgu açısından, verilerle ne olduğunu görebiliriz, hangi tür join'lar — orada hangi tür join'lar görebileceğimizi?
Kafka ile hiçbir şey zor değil, önemli olan verileri işlemek — hangi detaylara dikkat edilmesi gerekiyor?
Kafka'dan ClickHouse'a gerçek zamanlı raporlama için streaming yoluyla nasıl veri yüklenir?
4 kişilik bir ekipte lider ya da başka biri mi yönetiyordu?
ClickHouse'ta hangi okuma türü kullanılır?
Depolama, Data Vault şemasına göre inşa edildi — sen de onu geliştirdin, destekledin mi? Kendi ellerinle hub'lar, bağlantılar ekledin mi?
Greenplum ve Trino'dan ClickHouse'a verileri nasıl aktarabiliriz?
Greenplum hangi tipe daha çok ait — OLTP mi yoksa OLAP mı?
Zaten bazı iş tekliflerin var mı?
Takası dosyaları performansı nasıl etkiler? Başka ne zaman takas dosyaları oluşabilir?
Greenplum'ta ACID uyuluyor mu?
Data Science ve büyük veri işlemleriniz için Rust'ta yazılmış, çok iş parçacıklı ve çok hızlı olan böyle bir kütüphane biliyor musun? Pandas yerine kullanılabilir.