Kako je organizovan PostgreSQL klaster? Šema replikacije i otpornosti na kvarove?
DBA / Database
Представите занимљив задатак који сте решили на претходном радном месту.
Zadatak 5: EXPLAIN prikazuje type: ALL, rows: 200000, Using temporary; Using filesort. Šta to znači i kako ga optimizovati?
Zadatak 1: Pronaći top-5 ruta (polazna stanica, dolazna stanica) po broju zadataka za januar 2025. iz tabele harvester_tasks_queue.
Da li je šema podataka normalizovana u vašem projektu? Kako ste pristupili normalizaciji?
Koje alate za praćenje ste koristili?
Zadatak 3: Pronađite duplikate zadataka (po departure_station, arrival_station, departure_date, crawler_id) i predložite plan za sigurno brisanje iz tabele harvester_tasks_queue.
Zadatak 4: Optimizujte upit WHERE DATE(tep.available_from_departure_date) = departureDate. Objasnite problem i predložite rešenje.
Kako zaštititi ciljnu tabelu od duplikata prilikom ubacivanja podataka iz privremene tabele? Kako ažurirati postojeće zapise novijim podacima (upsert)?
Kako ste se nosili sa deadlock-ovima u sistemu pod visokim opterećenjem? Šta ste radili kada ste ih otkrili?
Kako proveravate rezultate skladištene procedure ili upita? Metode i pristupi.
Kako organizovati arhitekturu tabele koja se širi, da se brzo radi samo sa svežim podacima? Kako efikasno brisati stare podatke?
Pitanje 2: Pronađite rute sa aktivnim zadacima (status = 'Spremno za početak'), ali bez ažuriranja duže od 30 dana. Šeme: harvester_tasks_queue i station__crawler_mapping_with_crawler_ids.
Da li ste imali slučajeve nadogradnje verzije proizvoda baze podataka? Kako ste se pripremili i koje su se probleme pojavile?
Реците о својој тренутној позицији: одговорности, тим, инфраструктура, алати.