O pozici
Специалист будет отвечать за эксплуатацию и развитие инфраструктуры, Kubernetes-кластеров, систем мониторинга, очередей и CI/CD. Важная часть роли — обеспечение стабильности систем, расследование инцидентов и автоматизация инфраструктурных процессов.
Обязанности
- Поддерживать, развивать и мониторить существующие Kubernetes-кластеры
- Поддерживать и мониторить PostgreSQL, Redis и ClickHouse, выявлять узкие места СУБД и key-value хранилищ
- Поддерживать бесперебойную работу систем очередей на базе Kafka и RabbitMQ
- Поддерживать и развивать систему мониторинга и алертинга на базе Prometheus, Thanos, Alertmanager и Grafana