Sobes.tech

SRE / Platform Engineer

Le problème a été confirmé, que faire ensuite?

343

L'incident a été résolu, le service restauré - est-ce tout ou faut-il faire autre chose?

341

Quelle est la différence entre Prometheus et VictoriaMetrics ? Comment avez-vous configuré le scraping depuis plusieurs clusters ?

319

Comment voir s'il y a eu des changements, qui a déployé quoi?

275

Comment un paquet voyage-t-il d'un client externe à un pod dans un autre namespace?

198

Qu'est-ce qui contrôle la quantité de pods?

194

Quels points doivent être abordés lors du post-mortem?

190

Quelle est la différence entre Deployment, StatefulSet et DaemonSet?

190

Comment avez-vous assuré la tolérance aux pannes de la plateforme Kafka?

189

Comment avez-vous configuré la surveillance pour le nouveau service ? Comment stocker les tableaux de bord ?

189

Parlez-moi de vous et de votre expérience

186

Quelle est la différence technique fondamentale entre FluxCD et ArgoCD ? Modèle Pull vs Push ?

185

Faut-il informer les utilisateurs de l'incident?

185

Que se passe-t-il si vous supprimez manuellement les pods de StatefulSet et DaemonSet ?

178

Comment l'intégration avec Vault a-t-elle été organisée ? Comment les secrets ont-ils été rotés ?

177

Quelles sont les vérifications de readiness, liveness et startup ?

173

Classes de QoS dans Kubernetes : Garantie, Burst, Meilleur Effort

168

Comment réparer si le service garde un ancien secret en mémoire?

168

Avez-vous créé des tableaux de bord dans Grafana ? Comment les entreteniez-vous ?

167

Qu'est-ce que PodDisruptionBudget ?

167
/2