Kuidas oli organiseeritud PostgreSQL klaster? Replikatsiooni skeem ja tõrkekindlus?
DBA / Database
Esitage huvitav ülesanne, mille lahendasite eelmisel töökohtumisel.
Ülesanne 5: EXPLAIN näitab type: ALL, rows: 200000, Using temporary; Using filesort. Mida see tähendab ja kuidas seda optimeerida?
Kas teie projektis andmeskeem normaliseeriti? Kuidas normaliseerimisega lähenesite?
Ülesanne 1: Leia 2025. aasta jaanuarist harvester_tasks_queue tabelist TOP-5 marsruudid (väljumisjaam, saabumisjaam) ülesannete arvust.
Milliseid jälgimisvahendeid olete kasutanud?
Ülesanne 3: Leia dubleeritud ülesanded (departure_station, arrival_station, departure_date, crawler_id) ja pakkuda ohutut kustutamise plaani harvester_tasks_queue tabelist.
Ülesanne 4: Optimeerige päring WHERE DATE(tep.available_from_departure_date) = departureDate. Selgitage probleemi ja pakkuda lahendus.
Kuidas te lahendasite deadlock'e kõrge koormusega süsteemis? Mida te tegite nende avastamisel?
Kuidas kaitsta sihttabelit duplikaatide eest, sisestades andmeid ajutisest tabelist? Kuidas uuendada olemasolevaid kirjeid uuemate andmetega (upsert)?
Rääkige oma praegusest positsioonist: kohustused, meeskond, infrastruktuur, tööriistad.
Kuidas kontrollite salvestatud protseduuri või päringu tulemusi? Meetodid ja lähenemised.
Kuidas korraldada kasvavat tabeli arhitektuuri, et töötada kiiresti ainult värskete andmetega? Kuidas tõhusalt eemaldada vanu andmeid?
Küsimus 2: Leia marsruute koos aktiivsete ülesannetega (olek = 'Valmis alustamiseks'), kuid ilma uuendusteta üle 30 päeva. Skeemid: harvester_tasks_queue ja station__crawler_mapping_with_crawler_ids.
Kas teil on olnud andmebaasi toote versiooni uuendamise juhtumeid? Kuidas te valmistusite ja millised probleemid tekkisid?