Probleem on kinnitatud, mida edasi teha?
SRE / Platform Engineer
Juhtum lahendati, teenus taastatud - kas see on kõik või on veel midagi teha?
Mis vahe on Prometheus ja VictoriaMetrics vahel? Kuidas seadistasite scrape mitmest klasterist?
Kuidas näha, kas muudatusi tegi, kes mida rakendas?
Kuidas liigub pakett välisest kliendist teise namespace'i poodi?
Mis kontrollib podide arvu?
Millised punktid peaksid olema post-mortemil?
Mis vahe on Deployment, StatefulSet ja DaemonSet vahel?
Kuidas seadistas uue teenuse jälgimist? Kuidas hoida armatuurlaudu?
Kuidas tagasiteekonna Kafka platvormi töökindlust?
Kas on vaja teavitada kasutajaid juhtumist?
Mis on põhiline tehniline erinevus FluxCD ja ArgoCD vahel? Pull vs Push mudel?
Rääkige mulle endast ja oma kogemusest
Mis juhtub, kui käsitsi kustutate StatefulSet ja DaemonSet podid?
Kuidas oli korraldatud integratsioon Vaultiga? Kuidas salajasi rotatsiooni tehti?
Mis on readiness, liveness ja startup testid?
Kuidas parandada, kui teenus hoiab vanu saladust mälus?
Kas tegi dashboard'eid Grafana's? Kuidas te neid hooldasite?
Mis on PodDisruptionBudget?
Taints'i mõjud: NoSchedule, PreferNoSchedule, NoExecute - mis need on?