Ինչպե՞ս փոխանցել տվյալները Greenplum-ի մատակարարված տեսքից ClickHouse-ին:
Data Engineer
Ի՞նչ էր քո դերը 4 հոգանոց թիմում և ինչպես տեսնում ես քո կարիերան 3-4 տարվա ընթացքում, ինչ նպատակներ ես դնում։
Ընդհանուր քանի բեռնում էր — բարձր մակարդակի աշխատանքներ, թելեր?
Ինչքան լավ եք ճանաչում Python-ը։
CTE-ում շատ հիշողություն է օգտագործվում՝ երբ մենք մեծ հիշողության սպառում ունենք, ինչ է տեղի ունենում տվյալների հետ?
Մեծ պահեստը — որքան դժվար էր այն ձեռքով պահել ծավալներում և օբյեկտներում?
Հարցման առումով մենք կարող ենք տեսնել, թե ինչ է տեղի ունենում տվյալների հետ, այդ թվում՝ ինչ տեսակի միացումներ — ինչ տեսակի միացումներ կարող ենք տեսնել այնտեղ?
Ինչպես բեռնել տվյալները Kafka-ից ClickHouse՝ ռեալ ժամանակի հաշվետվությունների համար՝ streaming-ի միջոցով:
Ի՞նչ տիպի ընթերցում է օգտագործվում ClickHouse-ում։
Մենք մուտքագրում ենք մետադատությունները որպես մուտք, և նա հիմք ընդունելով այդ մետադատությունները՝ ստեղծում է հոսք — ինչպես դա կօգնի արագ տեղափոխել առկա հոսքերը հին համակարգերից դեպի պլանավորվածները?
Անալիտիկ ֆունկցիաները (վինդոու ֆունկցիաներ) ինչպես էին աշխատում?
Կաֆկայի հետ ոչինչ դժվար չէ, գլխավորն է տվյալները մշակել — ինչ նրբություններ պետք է հաշվի առնել?
Կա՞ր առաջնորդ կամ ուրիշ մեկը ղեկավարում էր 4 հոգանոց թիմը։
Ինչպե՞ս փոխանցել տվյալները Greenplum և Trino-ից դեպի ClickHouse։
Պահոցը կառուցվել է Data Vault սխեմայի համաձայն — դու էլ զարգացար, պահպանում էիր? Հավաքածու, հղումներ ձեռքով ավելացնո՞ւմ էիր։
Նո՞ւյն եք գիտե՞լ Rust-ով գրված բազմատողային, շատ արագ գրադարան, որը կարող է փոխարինել Pandas-ին Data Science և Big Data-ի համար։
Արդյո՞ք Greenplum-ում պահպանվում է ACID-ը։
Դու արդեն ունես աշխատանքային առաջարկներ?
Greenplum որ տեսակի ավելի է պատկանում՝ OLTP թե OLAP?
Ի՞նչ տարբերություն կա CTE-ի և ենթադրության միջև։