Sobes.tech

Data Engineer

Milliseid täiendavaid DDL/CREATE TABLE parameetreid ClickHouse'is teate, millele need mõjuvad ja millal neid kasutatakse?

206

Kuidas jaotada selle vitriini andmed ebavõrdselt kolmele shardile: 50% esimesel ja 25% teistel kahel?

191

Kuidas loodi tabelid klastris ja kuidas lahendati probleem, kui ZooKeeperi tõttu puudus replika ühel shardil?

189

Kuidas lahendasite optimeerimisprobleeme, kui päring kestab kaua ja teostab täieliku skannimise? Kuidas läheneksite sellisele uuele ülesandele?

180

Millistel juhtudel võib ClickHouse'i Materialized View andmeid vahele jätta või vastupidi, duplitseerida?

169

Kas teiega on kunagi juhtunud ClickHouse `Too many parts` viga sisestamisel? Kuidas te selle lahendasite?

165

Rääkige meile rohkem andmete kallutatusest shardide vahel: kuidas seda määratleti ja kuidas kasutati vastavat funktsiooni/mekhanismi?

160

Kas teadsite UDF-dest (Kasutaja määratletud funktsioonidest) ClickHouse'is, kas olete nendega töötanud?

141

Kuidas te parandasite andmete kallutat client_id järgi, kui üks klient oli oluliselt suurem kui teised? Millised on võimalused?

138

Milliste Distributed mootori parameetritega olete ClickHouse'is tuttav?

134

Kuidas teeksite Materialized View ahelaga läbi vahepealse ReplacingMergeTree tabeli, et õigesti täita juba olemasolevad andmed enne uue MV käivitamist?

131

Millistel väljadelt toimus andmete ühendamine ja kuidas eemaldati duplikaadid vitriinist?

128

Kuidas korraldada andmete laadimine ClickHouse'i suure PostgreSQL-tabeli puhul, kuhu pidevalt tulevad uued kirjed monotoniliselt kasvava primaarvõtmega?

124

Kas teate ReplicatedQueue'ist? Kas teil on selle kasutamise kogemust?

116