Sobes.tech

SRE / Platform Engineer

Il problema è stato confermato, cosa fare dopo?

341

L'incidente è stato risolto, il servizio ripristinato - è tutto o c'è qualcos'altro da fare?

333

Qual è la differenza tra Prometheus e VictoriaMetrics? Come hai configurato lo scraping da più cluster?

319

Come verificare se ci sono state modifiche, chi ha distribuito cosa?

275

Come viaggia un pacchetto da un client esterno a un pod in un altro namespace?

198

Cosa controlla la quantità di pod?

194

Quali punti devono essere presenti nel post-mortem?

190

Qual è la differenza tra Deployment, StatefulSet e DaemonSet?

190

Come hai garantito la tolleranza ai guasti della piattaforma Kafka?

189

Come hai configurato il monitoraggio per il nuovo servizio? Come conservare i dashboard?

189

È necessario informare gli utenti dell'incidente?

185

Qual è la differenza tecnica fondamentale tra FluxCD e ArgoCD? Modello Pull vs Push?

185

Parlami di te e della tua esperienza

184

Cosa succede se si eliminano manualmente i pod di StatefulSet e DaemonSet?

178

Come è stata organizzata l'integrazione con Vault? Come sono stati ruotati i segreti?

177

Cosa sono i test di readiness, liveness e startup?

173

Come riparare se il servizio tiene un vecchio segreto in memoria?

168

Hai creato dashboard in Grafana? Come li hai mantenuti?

167

Effetti dei taints: NoSchedule, PreferNoSchedule, NoExecute - cosa sono?

166
/2