Ako bol organizovaný PostgreSQL klaster? Schéma replikácie a odolnosti voči výpadkom?
DBA / Database
Uveďte zaujímavú úlohu, ktorú ste riešili na predchádzajúcom pracovisku.
Vaja 5: EXPLAIN prikazuje type: ALL, rows: 200000, Using temporary; Using filesort. Kaj to pomeni in kako ga optimizirati?
Úloha 1: Nájdite top 5 trás (odchodová stanica, cieľová stanica) podľa počtu úloh za január 2025 z tabuľky harvester_tasks_queue.
Bol v vašom projekte normalizovaný dátový schéma? Ako ste pristúpili k normalizácii?
Aké nástroje na monitorovanie ste použili?
Úloha 3: Nájdite duplikáty úloh (podľa departure_station, arrival_station, departure_date, crawler_id) a navrhnite plán bezpečného odstránenia z tabuľky harvester_tasks_queue.
Úloha 4: Optimalizujte dopyt WHERE DATE(tep.available_from_departure_date) = departureDate. Vysvetlite problém a navrhnite riešenie.
Ako zaščititi ciljno tabelo pred podvoji pri vstavljanju podatkov iz začasne tabele? Kako posodobiti obstoječe zapise z novejšimi podatki (upsert)?
Ako ste riešili deadlocky v systéme s vysokým zaťažením? Čo ste robili pri ich zistení?
Ako kontrolujete rezultate uloženého postupu alebo dotazu? Metódy a prístupy.
Ako organizovať arhitektúru tabuľky, ktorá sa rozrastá, aby sa s ňou dalo rýchlo pracovať len s čerstvými dátami? Ako efektívne odstraňovať staré dáta?
Otázka 2: Nájdite trasy s aktívnymi úlohami (stav = 'Pripravené na začatie'), ale bez aktualizácií viac ako 30 dní. Schémy: harvester_tasks_queue a station__crawler_mapping_with_crawler_ids.
Mali ste prípady aktualizácie verzie produktu databázy? Ako ste sa pripravili a aké problémy sa vyskytli?
Povedzte mi o svojej súčasnej pozícii: povinnosti, tím, infraštruktúra, nástroje.