Sobes.tech

Data Engineer

Ի՞նչ լրացուցիչ պարամետրեր DDL/CREATE TABLE- ի մասին գիտեք ClickHouse-ում, դրանք ինչի վրա են ազդում և ինչ դեպքերում են օգտագործվում։

198

Ինչպես ստեղծվեցին սեղանները կլաստերում և ինչպես լուծվեց խնդիրը, երբ ZooKeeper-ի պատճառով շարդում ռեպլիկը բաց էր:

189

Ինչպես անհամամասնորեն բաժանել այս վիտրինայի տվյալները երեք shard-ների վրա՝ 50% առաջինում և 25% մյուս երկուում?

189

Ինչպես եք դուք ճիշտ կարդում Parquet-ը։

176

Ինչպե՞ս եք լուծել օպտիմիզացիայի խնդիրները, երբ հարցումը երկար է տևում և իրականացնում է լրիվ սկան: Ինչպե՞ս մոտենաք նման նոր խնդիրներին։

176

Որ դեպքերում կարող է ClickHouse-ի Materialized View-ը բաց թողնել տվյալները կամ, հակառակը, կրկնօրինակել դրանք?

169

Դուք երբևէ հանդիպե՞լ եք ClickHouse `Too many parts` սխալի հետ մուտքագրելիս: Ինչպե՞ս եք լուծել այն։

165

Ի՞նչ Python գրադարանների հետ եք աշխատել:

162

Ավելացրեք ավելի մանրամասն տեղեկություններ շարդների միջև տվյալների խեղաթյուրումների մասին. ինչպես որոշվեց և ինչպես օգտագործվեց համապատասխան ֆունկցիան/մեխանիզմը։

160

Դուք ծանոթ եք ClickHouse-ում օգտագործողի սահմանած ֆունկցիաներին (UDF), արդյոք աշխատել եք դրանց հետ?

141

Ինչպե՞ս եք ուղղել տվյալների խեղաթյուրումը client_id-ի միջոցով, երբ մի հաճախորդ զգալիորեն մեծ էր մյուսների համեմատ: Ինչ տարբերակներ կան?

138

Ի՞նչ պարամետրերով եք ծանոթ Distributed շարժիչի մեջ ClickHouse-ում։

131

Ինչպե՞ս կվարվեիք Materialized View շղթայի հետ՝ միջնորդական ReplacingMergeTree աղյուսակի միջոցով՝ ճիշտ կերպով լրացնելու համար տվյալները, որոնք արդեն գոյություն ունեն նախքան նոր MV-ի գործարկումը։

129

Որ տարբերակով Airflow եք աշխատել?

127

Որ դաշտերում էր տվյալների միացումը և ինչպես հեռացվեցին կրկնօրինակները վիտրինայում?

125

Ինչպես կազմակերպել տվյալների բեռնումը ClickHouse-ում մեծ PostgreSQL աղյուսակում, որտեղ մշտապես գալիս են նոր գրառումներ մոնոտոնիկ աճող հիմնական բանալիով?

124

Դու գիտե՞ք ReplicatedQueue- ը: Արդյոք աշխատել եք նրա հետ:

113