Το πρόβλημα επιβεβαιώθηκε, τι πρέπει να κάνουμε στη συνέχεια;
SRE / Platform Engineer
Ο περιστατικό λύθηκε, η υπηρεσία αποκαταστάθηκε - είναι όλα ή πρέπει να κάνουμε κάτι άλλο;
Ποια είναι η διαφορά μεταξύ Prometheus και VictoriaMetrics; Πώς ρύθμισες το scraping από πολλαπλά clusters;
Πώς να δεις αν έγιναν αλλαγές, ποιος ανέπτυξε τι;
Πώς πηγαίνει ένα πακέτο από έναν εξωτερικό πελάτη σε ένα pod σε άλλο namespace;
Τι ελέγχει την ποσότητα των pods;
Ποια σημεία πρέπει να υπάρχουν στην μεταθανάτια εξέταση;
Ποια είναι η διαφορά μεταξύ Deployment, StatefulSet και DaemonSet;
Πώς ρυθμίσατε την παρακολούθηση για τη νέα υπηρεσία; Πώς αποθηκεύετε τα dashboards;
Πώς διασφαλίσατε την ανθεκτικότητα της πλατφόρμας Kafka;
Πρέπει να ενημερώνονται οι χρήστες για το περιστατικό;
Ποια είναι η βασική τεχνική διαφορά μεταξύ FluxCD και ArgoCD; Μοντέλο Pull vs Push;
Πείτε μου για εσάς και την εμπειρία σας
Τι συμβαίνει αν διαγράψετε χειροκίνητα τα pods του StatefulSet και του DaemonSet;
Πώς ήταν οργανωμένη η ενσωμάτωση με το Vault; Πώς περιστρέφονταν τα μυστικά;
Τι είναι οι δοκιμές readiness, liveness και startup;
Πώς να διορθώσετε αν η υπηρεσία κρατάει ένα παλιό μυστικό στη μνήμη;
Έχετε δημιουργήσει πίνακες ελέγχου στο Grafana; Πώς τους διατηρούσατε;
Τι είναι το PodDisruptionBudget;
Επιδράσεις των taints: NoSchedule, PreferNoSchedule, NoExecute - τι είναι;