PostgreSQL кластерин кантип уюштурду? Репликация схемасы жана иштен чыгуу туруктуулугу?
DBA / Database
Элдеги иш ордунда чечкен кызыктуу тапшырмаңызды көрсөтүңүз.
1-чи тапшырма: EXPLAIN type: ALL, rows: 200000, Using temporary; Using filesort көрсөтүүдө. Бул эмне жана аны кандай оптималдаштырууга болот?
Үйрөнүү 1: 2025-жылдын январь айындагы harvester_tasks_queue таблицасынан тапшырмалардын саны боюнча топ-5 маршруттарды (учуптук станциясы, келүү станциясы) табыңыз.
Сиздин долбоордо маалыматтар схемасы нормалдаштырылдыбы? Нормалдаштырууга кандай карадыңыз?
Кайсы мониторинг инструменттерин колдондуңуз?
Үй тапшырмасы 3: Көбөйтүлгөн тапшырмаларды (departure_station, arrival_station, departure_date, crawler_id боюнча) табып, harvester_tasks_queue таблицасынан коопсуз өчүрүү планы сунуштаңыз.
Тапшырма 4: WHERE DATE(tep.available_from_departure_date) = departureDate суроолун оптималдаштырыңыз. Мәселені түшіндіріп, чечим сунуштаңыз.
Жогорку жүктөмдүү системада deadlock-тарды кантип чечтиңиз? Алар аныкталганда эмне кылдыңыз?
Максаттуу таблицаны дублдардан кантип коргоо керек, убакыттык таблицадан маалымат киргизүүдө? Эмне үчүн бардык жазууларды жаңыртуу керек (upsert)?
Сакталган процедура же суроо-талаптын натыйжаларын кантип текшересиз? Ылдамдар жана ыкмалар.
Кандай уюштурууга болот, өсүп жаткан таблицанын архитектурасы, тезирек гана жаңы маалыматтар менен иштөө үчүн? Эски маалыматтарды кантип натыйжалуу өчүрсө болот?
Суроо 2: Идараттар менен иштери бар маршруттарды табыңыз (статус = 'Баштоо даяр'), бирок 30+ күндөн бери жаңыртуулар жок. Шаблондар: harvester_tasks_queue жана station__crawler_mapping_with_crawler_ids.
Маалыматтар базасынын продукт версиясын жаңылоо учурлары болду беле? Кантип даярдандыңыз жана кандай көйгөйлөр пайда болду?
Учурдагы ордуңуз тууралуу айтып бериңиз: милдеттер, команда, инфраструктура, инструменттер.