Sobes.tech

Data Engineer

Welke aanvullende parameters van DDL/CREATE TABLE in ClickHouse ken je, waarop ze invloed hebben en in welke gevallen worden ze gebruikt?

213

Hoe implementeer je een ongelijke verdeling van gegevens in de vitrine: 50% op de eerste en 25% op de andere twee?

193

Hoe zijn de tabellen in de cluster gemaakt en hoe is het probleem opgelost toen er vanwege ZooKeeper een replica ontbrak op een shard?

190

Hoe hebt u optimalisatieproblemen opgelost wanneer een query lang duurt en een volledige scan uitvoert? Hoe zou u een nieuwe dergelijke taak aanpakken?

183

In welke gevallen kan een Gematerialiseerde Weergave in ClickHouse gegevens missen of juist dupliceren?

173

Bent u ooit de fout `Too many parts` van ClickHouse tegengekomen bij het invoegen? Hoe hebt u het opgelost?

167

Vertel meer over de dataverschuiving tussen de shards: hoe werd het bepaald en hoe werd de bijbehorende functie/mechanisme gebruikt?

164

Bent u bekend met UDF (User Defined Functions) in ClickHouse, hebt u er mee gewerkt?

143

Hoe heb je de dataverschuiving op basis van client_id gecorrigeerd wanneer één klant aanzienlijk groter was dan de anderen? Welke opties zijn er?

139

Met welke parameters van de Distributed-motor in ClickHouse bent u vertrouwd?

135

Hoe zou je de Materialized View-keten via een tussenliggende ReplacingMergeTree-tabel aanpakken om correct de gegevens te vullen die al bestonden vóór het lanceren van de nieuwe MV?

133

Op welke velden vond de gegevenssamenvoeging plaats en hoe werden duplicaten in de vitrine verwijderd?

130

Hoe organiseer je het laden van gegevens in ClickHouse in een grote PostgreSQL-tabel, waarin voortdurend nieuwe records met een monotoon groeiende primaire sleutel binnenkomen?

125

Bent u bekend met ReplicatedQueue? Heeft u ervaring met het werken ermee?

120