Ինչպես կազմակերպվեց PostgreSQL-ի կլաստերը: Կրկնօրինման սխեմա և անբասիրություն դիմակայություն?
DBA / Database
Ներկայացրեք հետաքրքիր խնդիր, որը դուք լուծել եք նախորդ աշխատավայրում։
Առաջադրանք 5: EXPLAIN ցույց է տալիս type: ALL, rows: 200000, Using temporary; Using filesort. Ի՞նչ է դա նշանակում և ինչպես օպտիմալացնել։
Նշանակվա՞ծ էր ձեր նախագծում տվյալների սխեման։ Ինչպե՞ս մոտեցաք նորմալացմանը։
Առաջադրանք 1: Գտեք 2025 թվականի հունվարի տվյալների աղյուսակից harvester_tasks_queue՝ ըստ առաջադրանքների քանակի, լավագույն 5 երթուղիները (վագոնային կայարան, ժամանման կայարան):
Ի՞նչ մոնիտորինգի գործիքներ եք օգտագործել:
Առաջադրանք 3: Գտեք կրկնվող առաջադրանքներ (departure_station, arrival_station, departure_date, crawler_id) և առաջարկեք անվտանգ հեռացման պլան harvester_tasks_queue աղյուսակից։
Առաջադրանք 4: Օպտիմալացրեք հարցումը WHERE DATE(tep.available_from_departure_date) = departureDate: Իմացեք խնդիրը և առաջարկեք լուծում։
Ինչպե՞ս եք վարվել բարձր բեռով համակարգում deadlock-ների հետ: Ի՞նչ եք արել նրանց հայտնաբերելու ժամանակ:
Ինչպես պաշտպանել նպատակային աղյուսակը կրկնօրինակումներից՝ տվյալներ ժամանակավոր աղյուսակից մուտք գործելիս: Ինչպես թարմացնել առկա գրառումները՝ ավելի նոր տվյալներով (upsert)?
Իմացեք ձեր ընթացիկ դիրքի մասին՝ պարտականություններ, թիմ, ենթակառուցվածք, գործիքներ.
Ինչպե՞ս եք ստուգում պահվող գործընթացի կամ հարցման արդյունքները: Մեթոդներ և մոտեցումներ։
Ինչպե՞ս կազմակերպել աղյուսակի ճարտարապետությունը, որը աճում է, որպեսզի արագ աշխատի միայն թարմ տվյալների հետ: Ինչպե՞ս արդյունավետորեն հեռացնել հին տվյալները։
Հարց 2: Գտեք երթուղիներ ակտիվ առաջադրանքներով (պատկերը = 'Պատրաստ է սկսելու'), բայց առանց նորացումների 30+ օր։ Շաբլոններ: harvester_tasks_queue և station__crawler_mapping_with_crawler_ids։
Դուք ունեցել եք տվյալների բազայի արտադրանքի տարբերակի թարմացման դեպքեր: Ինչպե՞ս պատրաստվեցիք և ինչ խնդիրներ առաջացան: