Data Engineer
Ներկայացրեք մի օրինակ, երբ հաջողվեց բարելավել գործընթացները կամ գործիքները թիմի համար։
Նկարում ցույց տրված աղյուսակների կառուցվածքը ստեղծվել է։ Պետք է կատարել նկարի մեջ նշված հարցումը։ Որո՞նք են [...]-ի փոխարեն օգտագործելի join տեսակը, որպեսզի արդյունքում type = 'table_aw' համար լրացվի 'naming' սյունակը, իսկ type = 'table2' համար՝ 'serial_number' սյունակը: create table multirelation( type varchar not null, entity_id integer not null ); create table table_aw( id integer primary key, naming varchar not null ); create table table2( id integer primary key, serial_number varchar not null ); -- աղյուսակների կառուցվածք select m.type,m.entity_id, ta.naming, t2.serial_number from multirelation m [...] join table_aw ta on m.entity_id = ta.id and m.type='table_aw' [...] join table2 t2 on m.entity_id = t2.id and m.type='table2'; -- հարցում Դուրս թողեք դատարկ inner cross right left
Ի՞նչ էին տվյալների սպառողները և ինչպես կառուցվում էին վիտրինաները։
Ի՞նչ տեղի ունեցավ և ինչպես վերականգնել աշխատանքը։
Ի՞նչն է տարբեր Greenplum-ի և PostgreSQL-ի միջև։
Որքան աշխատավարձ եք սպասում?
Отчет для лагістычнай кампаніі Вы аналітык лагістычнай кампаніі, якая вядзе ўлік аперацый на складах. Вам неабходна скласці справаздачу па эфектыўнасці працы кожнага склада. Для кожнага склада разлічыце: • агульную колькасць аперацый (count_operations); • агульную колькасць тавараў, апрацаваных на складзе (sum_quantity); • сярэдні час апрацоўкі аперацыі (avg_processing_time), улічваючы толькі аперацыі з указаным часам (не NULL), заакруглены да цэлага ліку; • максімальную і мінімальную колькасць тавараў, апрацаваных у адной аперацыі (max_quantity, min_quantity); • колькасць аперацый кожнага тыпу («пастаўка», «адгрузка», «перамяшчэнне») у асобных калонках: supply_operations, shipment_operations, transfer_operations. Адфільтруйце склады, у якіх агульная колькасць аперацый больш за 2 і сярэдні час апрацоўкі не перавышае 60 хвілін. Адсартуйце вынік па ID склада ў парадку ўзрастання. Фармат уводных дадзеных Табліца operations: • operation_id (int) — унікальны ідэнтыфікатар аперацыі • warehouse_id (int) — ідэнтыфікатар склада • operation_type (text) — тып аперацыі: «пастаўка», «адгрузка», «перамяшчэнне» • quantity (int) — колькасць адзінак тавару ў аперацыі • operation_date (timestamp) — дата і час аперацыі • processing_time (int) — час апрацоўкі аперацыі Калонка processing_time можа ўтрымліваць пропускі. Фармат вываду Запыт павінен вярнуць табліцу з палямі ў такім парадку: • warehouse_id (int) — унікальны ідэнтыфікатар склада • count_operations (int) — агульная колькасць аперацый, выкананых на складзе • sum_quantity (int) — агульная колькасць тавараў, апрацаваных на складзе • avg_processing_time (numeric) — сярэдні час апрацоўкі аперацыі (у мінутах), улічваючы толькі аперацыі з не NULL часам, заакруглены да цэлага ліку • max_quantity (int) — максімальная колькасць тавараў, апрацаваных у адной аперацыі • min_quantity (int) — мінімальная колькасць тавараў, апрацаваных у адной аперацыі • supply_operations (int) — колькасць аперацый тыпу «пастаўка» • shipment_operations (int) — колькасць аперацый тыпу «адгрузка» • transfer_operations (int) — колькасць аперацый тыпу «перамяшчэнне»
Ի՞նչ առանձնահատկություններ և տարբերություններ կան Set և List-ների միջև Python-ում: Բացի կատարողականությունից, ինչ այլ առանձնահատկություններ կան?
Ինչպե՞ս է Spark-ը որոշում, որ աղյուսակը բավականին 'փոքր' է broadcast join-ի համար (վերին սահմանը):
Ինչպե՞ս եք սովորաբար կազմակերպում ձեր աշխատանքը առաջադրանքների վրա և ինչպես հետևում եք առաջընթացին։
Կա՞ն Greenplum-ում այնպիսի ֆունկցիաներ և հնարավորություններ, որոնք չկան սովորական MySQL-ում և այլ դիալեկտներում։
[անուն] հարցրեց: Ինչպես իրականացնել տվյալների պահպանումը միայն 2 տարի՝ում ClickHouse?
Որ աշխատանքային ձևաչափը ձեզ համար ավելի հարմար է — գրասենյակ, հիբրիդ կամ հեռավար? Մեր մոտ երկու գրասենյակ կա, Կուտուզովսկիում և Թուլայում։
Ամեն դեպքում, EXPLAIN-ի կատարողական պլանը համապատասխանում է իրականում կատարվողին:
Ինչպե՞ս ապահովել, որ մոբայլ հաճախորդը հասանելի լինի նույն պատվերներին, բայց ավելի փոքր դաշտերով: Ի՞նչ է BFF-ը։
Դուք ունեք հարցում, որը վատ է աշխատում, դանդաղ է կամ ընկնում է — ինչպես օպտիմալացնել այն؟
Ավելացրեք ավելի մանրամասն տեղեկություններ շարդների միջև տվյալների խեղաթյուրումների մասին. ինչպես որոշվեց և ինչպես օգտագործվեց համապատասխան ֆունկցիան/մեխանիզմը։
Խոսեք ձեր աշխատանքի մեջ PL/SQL պրոցեդուրաների օգտագործման մասին։
Ձախ կողմի միացում: աղյուսակ, որը ունի 10 գրանցում, Ձախ կողմի միացում՝ աղյուսակ, որը ունի 100 գրանցում: Ինչպիսի՞ն կարող է լինել ստացվող տողերի նվազագույն և առավելագույն քանակը։
Ինչպես օպտիմալացրին աղյուսակները և հարցումները՝ բաժանումներ, ինդեքսներ, ընտրության տրամաբանություն։