Rääkige mulle üksikasjalikumalt Kafka töö kohta: kuidas täpselt toimus sõnumite duplikeerimine?
Golang
Millised on replikatsiooni tüübid (sünkroonne ja asünkroonne)? Kuidas töötab sünkroonne replikatsioon ja millised on selle kulud?
Rääkige meile meeskonna koosseisust, teenuste vastutusaladest ja väljaandmise tsüklist.
Miks valiti gRPC REST asemel? Kas olid konkreetseid jõudluse nõudeid?
Kohaliku juhtumi: teenus kukub (OOM kill), sa ei näe vigu, kuid podis näed, et viimane staatus näitab mälu puudust. Milline oleks tegevuste järjekord teenuse diagnoosimiseks ja stabiliseerimiseks?
Kas vastutas toote kasutamise eest? Kas tugi oli teie meeskonnale? Kas teated ja mõõdikud suunati teie poole?
Milleks on andmebaasides tehingud vaja?
Kas aitab, kui lisada rohkem consumer'eid suure Kafka lag'i korral? Millistel juhtudel see aitab ja millistel mitte? Mis juhtub, kui on 16 partitsiooni ja 2 consumer'it?
Kas võib olla, et sõnumid on jaotatud ebaühtlaselt partition'ide vahel? Kuidas sellega võidelda?
Kas sa salvestasid kõik Kafka sõnumid eraldi tabelisse? Mis mõte sellel oli, kas Kafka ei olnud piisav?
Mida te tegite viimases töökohas? Millisel projektil töötasite?
Kas teil oli sidecar konteinerid instantsidel? Mis asi on sidecar?
Kas teiega otse suheldi Kubernetesiga?
Mis vahe on EXPLAIN ja EXPLAIN ANALYZE vahel? Miks ei tohiks EXPLAIN ANALYZE'i tootmises kasutada?
Mida teed sellisel juhul, kui hoiatus aktiveeriti RPS tõustes kuni 5000? Kuidas määrasid, kas oli tõeline koormuse kasv või süsteemi probleem?
Miks tehti käsitsi commit offset asemel automaatset?
Millised olid täpselt läbilaskevõime näitajad? Kui palju päringuid sekundis tavaliselt ja tipptunnil?
Kuidas te sooritasite Kafka tarbijate skaleerimise? Milliste kriteeriumide järgi?
Kui andmebaas pole saadaval ja teete uuesti katset, kas ei tööta lõpmatuseni samade sõnumitega? Kas kõik 500 lähevad DLQ-sse?
Rääkige minust enda kohta.