Data Engineer
Որ աշխատանքային ձևաչափը ձեզ համար ավելի հարմար է — գրասենյակ, հիբրիդ կամ հեռավար? Մեր մոտ երկու գրասենյակ կա, Կուտուզովսկիում և Թուլայում։
Մեր թեման շատ կառուցվածքային է, ծառի տեսքով, տվյալները կեղտոտ են — ինչպես մշակել դրանք?
Ամեն դեպքում, EXPLAIN-ի կատարողական պլանը համապատասխանում է իրականում կատարվողին:
Ինչպե՞ս ապահովել, որ մոբայլ հաճախորդը հասանելի լինի նույն պատվերներին, բայց ավելի փոքր դաշտերով: Ի՞նչ է BFF-ը։
Դուք ունեք հարցում, որը վատ է աշխատում, դանդաղ է կամ ընկնում է — ինչպես օպտիմալացնել այն؟
Ավելացրեք ավելի մանրամասն տեղեկություններ շարդների միջև տվյալների խեղաթյուրումների մասին. ինչպես որոշվեց և ինչպես օգտագործվեց համապատասխան ֆունկցիան/մեխանիզմը։
Դու աշխատե՞լ ես պատուհանի ֆունկցիաների հետ: Ի՞նչ տեսակի պատուհանի ֆունկցիաներ գիտես։
Խոսեք ձեր աշխատանքի մեջ PL/SQL պրոցեդուրաների օգտագործման մասին։
Ինչպես օպտիմալացրին աղյուսակները և հարցումները՝ բաժանումներ, ինդեքսներ, ընտրության տրամաբանություն։
Ի՞նչ է վիճակագրությունը տվյալների բազաների կառավարման համակարգերի և հարցումների օպտիմալացման համատեքստում։
Մեր մոտ հաճախորդների աղյուսակ կա (id, անուն, հասցե և այլն), ապրանքներ (id, անուն և այլն), ապրանքների շարժում (այստեղ ունենք հաճախորդի id, ապրանք, ամսաթիվ, քանակ, գումար), պետք է գտնենք, թե որ ապրանքները վաճառվել են 1 հունվարի, միայն եզակի, և նաև ցույց տալ գնորդի անունը և...
Դու ունե՞ս փորձ Docker պատկերների հետ, միջավայր ստեղծելու վիրտուալ մեքենայում։
Ի՞նչ մեթոդներ (տիպեր) գիտեք տվյալների պատմության պահպանումը: Ինչպես է հավաքվում պատմությունը աղյուսակներում?
Ինչպե՞ս էին տվյալները արտաքին աղյուսակից բեռնվում նպատակային աղյուսակների մեջ։
Ի՞նչ է տարբերությունը Python-ում is և == օպերատորների միջև։
Կա՞ն հարցեր թիմի և դերի մասին։
Ինչպես միացնել երկու աղյուսակ SQL-ում?
Դուք ծանոթ եք ընդհանուր աղյուսակային արտահայտություններին (CTE)? Տվեք օգտագործման օրինակ։
ստեղծեք raw.local_transactions աղյուսակը cluster_4x2 խմբում ( transaction_id String, user_id String, amount Float64, created_at DateTime ) շարժիչ = ReplicatedMergeTree() բաժանարար ըստ amount վերևում ըստ (transaction_id); ստեղծեք raw.transactions աղյուսակը cluster_4x2 խմբում ( transaction_id String, user_id String, amount Float64, created_at DateTime ) շարժիչ = Distributed('cluster_4x2', 'raw', 'local_transactions', cityHash64(user_id));
Արտադրվել է հատուկ հաջորդականություն, որի անվանումն է even_sequence, և այն միայն զույգ թվեր է արտադրում: Ի՞նչ պետք է տեղադրել [...]-ի փոխարեն, որպեսզի, եթե even_column արժեքը նշված չէ ներմուծման ժամանակ, արժեքը վերցվի even_sequence-ից: create table some_table( even_column [...] ); integer computed as nextval('even_sequence') integer generated always as identity (start with 2 increment by 2) integer default nextval('even_sequence') integer unique default nextval('even_sequence') integer generated by even_sequence’