Sobes.tech

Data Engineer

Jakie dodatkowe parametry DDL/CREATE TABLE w ClickHouse znasz, na co one wpływają i w jakich przypadkach są używane?

199

Jak tworzono tabele w klastrze i jak rozwiązano problem, gdy z powodu ZooKeeper brakowało repliki na shardzie?

189

Jak nierównomiernie rozłożyć dane tej witryny na trzy shard'y: 50% na pierwszym i po 25% na pozostałych dwóch?

189

Jak rozwiązywałeś problemy optymalizacyjne, gdy zapytanie działa długo i wykonuje pełny skan? Jak podszedłbyś do nowego takiego zadania?

177

W jakich przypadkach widok materializowany w ClickHouse może pominąć dane lub, odwrotnie, zdublować je?

169

Czy zdarzyło Ci się napotkać błąd ClickHouse `Too many parts` podczas wstawiania? Jak go rozwiązałeś?

165

Opowiedz więcej o przesunięciu danych między shardami: jak je określano i jak wykorzystywano odpowiednią funkcję/mechanizm?

160

Czy znasz UDF (Funkcje zdefiniowane przez użytkownika) w ClickHouse, czy pracowałeś z nimi?

141

Jak naprawiłeś błąd danych według client_id, gdy jeden klient był znacznie większy od pozostałych? Jakie są opcje?

138

Z jakimi parametrami silnika Distributed w ClickHouse jesteś zaznajomiony?

132

Jak postąpiłbyś z łańcuchem Materialized View przez pośrednią tabelę ReplacingMergeTree, aby poprawnie wypełnić dane już istniejące przed uruchomieniem nowej MV?

129

Po jakich polach odbyło się łączenie danych i jak usunięto duplikaty w witrynie?

126

Jak zorganizować ładowanie danych do ClickHouse w dużej tabeli PostgreSQL, do której stale trafiają nowe rekordy z monotonnie rosnącym kluczem głównym?

124

Czy znasz ReplicatedQueue? Czy masz doświadczenie w pracy z nią?

113