Sobes.tech

Data Engineer

Jak przenieść dane z materializowanego widoku w Greenplum do ClickHouse?

254

Jaka była Twoja rola w zespole 4-osobowym i jak widzisz swoją karierę za 3-4 lata, jakie cele sobie wyznaczasz?

235

Ile było łącznie pobrań — zadania na wysokim poziomie, wątki?

206

W CTE zużywa się dużo pamięci – gdy mamy duże zużycie pamięci, co się dzieje z danymi?

196

Duże przechowywanie było — jak trudne było utrzymanie go ręcznie w objętościach i obiektach?

194

Wprowadzamy metadane jako dane wejściowe, a on na ich podstawie tworzy przepływ — jak to umożliwi szybkie przeniesienie istniejących przepływów ze starych systemów do planowanych?

193

Z Kafka nic trudnego, najważniejsze jest przetwarzanie danych — na jakie niuanse należy zwrócić uwagę?

191

Jeśli chodzi o zapytanie, możemy zobaczyć, co się dzieje z danymi, w tym jakie typy joinów — jakie typy joinów możemy tam zobaczyć?

191

Jak ładować dane z Kafka do ClickHouse za pomocą streamingu do raportów w czasie rzeczywistym?

191

Jak działały funkcje analityczne (funkcje okienkowe)?

191

Jaki typ odczytu jest używany w ClickHouse?

190

Czy w zespole z 4 osób był jakiś lider lub ktoś inny nim kierował?

186

W jaki sposób można przesłać dane z Greenplum i Trino do ClickHouse?

182

Magazyn został zbudowany według schematu Data Vault — czy ty też go rozwijałeś, utrzymywałeś? Dodawałeś ręcznie huby, linki?

181

Czy znasz bibliotekę w Rust, wielowątkową, bardzo szybką, która może zastąpić Pandas w Data Science i Big Data?

178

Jak pliki swap wpływają na wydajność? Kiedy jeszcze mogą pojawić się pliki swap?

177

Do jakiego typu bardziej należy Greenplum — OLTP czy OLAP?

177

Data Vault to wygodne narzędzie, ale jest za dużo obiektów. Czy możesz wyjaśnić różnicę między hubami, linkami i satelitami?

177
/3