Como foi organizado o cluster PostgreSQL? Esquema de replicação e tolerância a falhas?
DBA / Database
Apresente uma questão interessante que resolveu no seu emprego anterior.
Tarefa 5: EXPLAIN mostra type: ALL, rows: 200000, Using temporary; Using filesort. O que isso significa e como otimizar?
A esquema de dados foi normalizado no seu projeto? Como abordou a normalização?
Tarefa 1: Encontrar os 5 principais roteiros (estação de partida, estação de chegada) com mais tarefas em janeiro de 2025 na tabela harvester_tasks_queue.
Que ferramentas de monitoramento você usou?
Tarefa 3: Encontrar duplicados de tarefas (por departure_station, arrival_station, departure_date, crawler_id) e propor um plano de eliminação segura da tabela harvester_tasks_queue.
Tarefa 4: Otimizar a consulta WHERE DATE(tep.available_from_departure_date) = departureDate. Explicar o problema e propor uma solução.
Como lidaram com deadlocks em um sistema de alta carga? O que fizeram ao detectá-los?
Como proteger a tabela de destino contra duplicados ao inserir dados de uma tabela temporária? Como atualizar os registros existentes com dados mais recentes (upsert)?
Fale sobre a sua posição atual: responsabilidades, equipa, infraestrutura, ferramentas.
Como você verifica os resultados de um procedimento armazenado ou consulta? Métodos e abordagens.
Como organizar a arquitetura de uma tabela que cresce, para trabalhar rapidamente apenas com dados recentes? Como eliminar eficazmente dados antigos?
Questão 2: Encontrar rotas com tarefas ativas (status = 'Pronto para iniciar'), mas sem atualizações há mais de 30 dias. Esquemas: harvester_tasks_queue e station__crawler_mapping_with_crawler_ids.
Teve casos de atualização de versão do produto de base de dados? Como se preparou e que problemas surgiram?