Sobes.tech

SRE / Platform Engineer

¿Se confirmó el problema, qué se debe hacer a continuación?

341

¿Se resolvió el incidente, se restauró el servicio o hay algo más que hacer?

333

¿Cuál es la diferencia entre Prometheus y VictoriaMetrics? ¿Cómo configuraste el scraping desde varios clústeres?

319

¿Cómo ver si hubo cambios, quién desplegó qué?

275

¿Cómo viaja un paquete desde un cliente externo hasta un pod en otro namespace?

198

¿Qué controla la cantidad de pods?

194

¿Qué puntos deben estar en la post-mortem?

190

¿Cuál es la diferencia entre Deployment, StatefulSet y DaemonSet?

190

¿Cómo configuraste la monitorización para el nuevo servicio? ¿Cómo guardar los paneles?

189

¿Cómo aseguraste la tolerancia a fallos de la plataforma Kafka?

189

¿Es necesario notificar a los usuarios sobre el incidente?

185

¿Cuál es la diferencia técnica fundamental entre FluxCD y ArgoCD? ¿Modelo Pull vs Push?

185

Cuéntame sobre ti y tu experiencia

178

¿Qué sucede si elimina manualmente los pods de StatefulSet y DaemonSet?

178

¿Cómo se integró con Vault? ¿Cómo se rotaron los secretos?

177

¿Qué son las pruebas de readiness, liveness y startup?

173

¿Cómo arreglar si el servicio mantiene un secreto antiguo en la memoria?

168

¿Creaste dashboards en Grafana? ¿Cómo los mantenías?

167

Efectos de taints: NoSchedule, PreferNoSchedule, NoExecute - ¿qué son?

166
/2