Hoe is de PostgreSQL-cluster georganiseerd? Repliekschema en fouttolerantie?
DBA / Database
Presenteer een interessante taak die u op uw vorige werk hebt opgelost.
Opdracht 5: EXPLAIN toont type: ALL, rows: 200000, Using temporary; Using filesort. Wat betekent dit en hoe te optimaliseren?
Taak 1: Vind de top 5 routes (vertrekstation, aankomststation) op basis van het aantal taken in januari 2025 uit de tabel harvester_tasks_queue.
Welke monitoring tools heb je gebruikt?
Is het datamodel genormaliseerd in uw project? Hoe hebt u de normalisatie aangepakt?
Taak 3: Dubbele taken (op basis van departure_station, arrival_station, departure_date, crawler_id) vinden en een veilig verwijderingsplan uit de tabel harvester_tasks_queue voorstellen.
Taak 4: Optimaliseer de query WHERE DATE(tep.available_from_departure_date) = departureDate. Leg het probleem uit en stel een oplossing voor.
Hoe bescherm je de doeltabel tegen duplicaten bij het invoegen van gegevens uit een tijdelijke tabel? Hoe werk je bestaande records bij met nieuwere gegevens (upsert)?
Hoe ging u om met deadlocks in een systeem met hoge belasting? Wat deed u bij het ontdekken ervan?
Hoe controleert u de resultaten van een opgeslagen procedure of query? Methoden en benaderingen.
Hoe organiseer je de architectuur van een tabel die groeit, om snel alleen met recente gegevens te werken? Hoe verwijder je oude gegevens effectief?
Vraag 2: Vind routes met actieve taken (status = 'Klaar om te starten'), maar zonder updates in meer dan 30 dagen. Schema's: harvester_tasks_queue en station__crawler_mapping_with_crawler_ids.
Heeft u gevallen gehad van het upgraden van de database productversie? Hoe bereidde u zich voor en welke problemen kwamen er voor?
Vertel eens over je huidige positie: verantwoordelijkheden, team, infrastructuur, tools.