Mesélj részletesebben a Kafka-val végzett munkáról: hogyan történt pontosan az üzenetek deduplikálása?
Golang
Milyen típusú replikációk léteznek (szinkron és aszinkron)? Hogyan működik a szinkron replikáció, és milyen költségei vannak?
Meséljen az csapat összetételéről, a szolgáltatások felelősségi területeiről és a kiadási ciklusról.
Miért a gRPC-t választották a REST helyett? Voltak-e konkrét teljesítménykövetelmények?
Absztrakt eset: a szolgáltatás leáll (OOM kill), nem látsz hibákat, de a podban az utolsó állapot memóriahiányt jelez. Mi lenne a teendők sorrendje a szolgáltatás diagnosztizálásához és stabilizálásához?
Ön voltál a termék működtetéséért? A támogatás a csapatodhoz tartozott? Az értesítések és metrikák hozzád érkeztek?
Miért szükségesek tranzakciók az adatbázisokban?
Segít-e, ha több fogyasztót adunk hozzá nagy Kafka-lag esetén? Milyen esetekben segít és milyen esetekben nem? Mi történik, ha 16 partíció van és 2 fogyasztó?
Előfordulhat, hogy az üzenetek egyenlőtlenül vannak elosztva a partíciók között? Hogyan lehet ezt kezelni?
Minden Kafka üzenetet külön táblába mentettél? Mi értelme volt ennek, nem volt elég a Kafka?
Mit csináltál az utolsó munkahelyeden? Milyen projekt volt?
Volt-e sidecar konténered az instanceken? Mi az a sidecar?
Közvetlenül kapcsolatba lépett a Kubernetes-szel?
Mi a különbség az EXPLAIN és az EXPLAIN ANALYZE között? Miért nem szabad az EXPLAIN ANALYZE-t éles környezetben használni?
Mit tettél ilyen esetben, amikor a riasztás akkor aktiválódott, amikor az RPS 5000-re nőtt? Hogyan határoztad meg, hogy valódi terhelésnövekedés vagy rendszerhiba áll fenn?
Miért készítettünk kézi offset commitet az automatikus commit helyett?
Milyen konkrét átviteli képesség mutatók voltak? Átlagosan és csúcsidőben hány kérés másodpercenként?
Hogyan skáláztad a Kafka fogyasztókat? Milyen kritériumok alapján?
Ha az adatbázis nem elérhető és újra próbálkozol, nem fogod végtelenül feldolgozni ugyanazokat az üzeneteket? Minden 500 a DLQ-be kerül?
Meséljen magáról.