Data Engineer
Ինչ փորձ ունեք SQL և հարաբերական տվյալների բազաների հետ?
Ինչպես է կազմակերպված ձեր QA-ն (տվյալների որակի ստուգում)?
Ի՞նչ կլինի, եթե կիրառեք `s ** 2` ցանկին `s = [1, 2, 3]`։
CREATE TABLE datamarts.daily_revenue_per_country ON CLUSTER cluster_4x2 ( event_date Date, country String, total_revenue Float64 ) ENGINE = MergeTree() PARTITION BY toYYYYMM(event_date) ORDER BY (event_date);
Կպատմե՞ք ինձ CI/CD գործընթացների, տվյալների բազայում փոփոխությունների, տարբերակավորման և սքեմայի միգրացիաների մասին (սքեմայի զարգացում):
Ի՞նչ մեթոդներ եք ճանաչում Airflow-ի առաջադրանքների միջև տվյալների փոխանցման համար:
Եվ եթե մեզ անհրաժեշտ են բոլոր հաճախորդները, նույնիսկ եթե նրանց այդ ամսաթվին գործարքներ չլինած լինեն, ինչպես դա ցույց տալ?
Ի՞նչ ծրագրեր ունես հաջորդ 5 տարվա համար: Որ ոլորտներում ուզում ես զարգանալ?
Օգտագործում եք արդյոք արհեստական բանականություն ձեր ընթացիկ աշխատանքի մեջ: Որ գործիքներն ու ինչպես հենց?
Դու աշխատե՞լ ես բեռնման խմբերով կամ հոսքով։
Ի՞նչ է CDC-ն և արդյոք ունեք դրա հետ աշխատանքային փորձ։
Կանխատեսում կա՝ տրանզակցիոն անջատման մակարդակներ։ Ինչ գիտեք այդ մասին։
Ի՞նչ տեսակի visualization գործիքներով եք աշխատել և որքան սերտորեն եք աշխատել Power BI- ի հետ։
Դուք աշխատե՞լ եք Python-ում կոնտեքստային մենեջերների հետ: Ի՞նչ են դրանք և ինչու են անհրաժեշտ:
Ինչ եք գիտակցում Spark/UDF կոնտեքստում սերիալիզացիայի և դեսերիալիզացիայի մասին?
Պատմիր տվյալների որակի մասին քո ըմբռնման մասին — արդյոք ունե՞ս այդ ոլորտում փորձառություն։
Իմացեք ձեր ներկայիս աշխատանքային վայրի մասին՝ հիմնական արտադրանք, ձեր գործառույթը։
Ի՞նչ հարցեր ունես ինձ համար։
միացեք clickhouse_driver from airflow.hooks.base import * def get_clickhouse_client(): conn = BaseHook.get_connection("clickhouse_default") return clickhouse_driver.Client( host=conn.host, port=conn.port, user=conn.login, password=conn.password, database=conn.schema )
Պատմեք ռեպլիկացիայի կարգավորման խնդիրն մասին, որը դուք լուծել եք։