Sobes.tech

SRE / Platform Engineer

O problema foi confirmado, o que fazer a seguir?

346

O incidente foi resolvido, o serviço foi restaurado - é tudo ou há mais alguma coisa a fazer?

343

Qual é a diferença entre Prometheus e VictoriaMetrics? Como configurou o scraping de vários clusters?

319

Como verificar se houve alterações, quem fez o que?

275

Como é que um pacote vai de um cliente externo até ao pod noutro namespace?

198

O que controla a quantidade de pods?

194

Quais pontos devem estar na análise pós-mortem?

190

Qual é a diferença entre Deployment, StatefulSet e DaemonSet?

190

Como configurou a monitorização para o novo serviço? Como guardar os painéis?

189

Como garantiu a tolerância a falhas da plataforma Kafka?

189

Fale sobre si e a sua experiência

188

É necessário notificar os utilizadores sobre o incidente?

185

Qual é a principal diferença técnica entre FluxCD e ArgoCD? Modelo Pull vs Push?

185

O que acontece se remover manualmente os pods do StatefulSet e do DaemonSet?

178

Como foi feita a integração com o Vault? Como foram rotacionados os segredos?

177

O que são as sondagens de readiness, liveness e startup?

173

Efeitos de taints: NoSchedule, PreferNoSchedule, NoExecute - o que são?

168

Como corrigir se o serviço mantém um segredo antigo na memória?

168

Classes de QoS no Kubernetes: Garantido, Burstável, Melhor Esforço

168

Você criou dashboards no Grafana? Como os manteve?

167
/2