O pozici
Ищут Site Reliability Engineer уровня Middle+ / Senior для поддержки, развития и наблюдаемости legacy-инфраструктуры на Rancher 1.6. Роль предполагает работу с сетями, балансировкой, мониторингом и low-level проблемами в production.
О компании и проекте
Международная логистическая компания GBS.
Проект связан с поддержкой и развитием legacy-инфраструктуры на базе Rancher 1.6.
Задачи
- Поддержка и развитие инфраструктуры на Rancher 1.6, включая контейнеризацию и управление окружениями
- Диагностика, оптимизация и обеспечение отказоустойчивости IPsec mesh и overlay-сетей
- Настройка и тюнинг HAProxy L4/L7 в связке с контейнерной средой
- Разработка инструментов автоматизации и наблюдаемости на Python
- Построение мониторинга на Prometheus: кастомные метрики, алерты и сбор данных с legacy-компонентов
- Troubleshooting production-инцидентов без готовых алертов
- Работа с PostgreSQL и RabbitMQ
- Написание документации и runbook’ов для типовых проблем
Требования
- Опыт в DevOps / SRE от 4 лет
- Уверенная практическая работа с Docker и контейнерами
- Опыт работы с HAProxy или аналогичными L7/L4-балансировщиками: настройка, релоады и debugging
- Опыт работы с Prometheus, включая написание кастомных экспортеров и метрик
- Глубокое понимание TCP/IP, VPN, особенно IPsec, overlay-сетей и маршрутизации
- Опыт troubleshooting production-инцидентов
Условия
- Уровень: Middle+ / Senior
- Полная занятость
- Гибридный формат
- Удалённая работа возможна через 3 месяца
- Локация: Москва
- Заработная плата: от 250 000 до 400 000 рублей gross, в зависимости от уровня
Отклик
Для отклика обращайтесь к @veretennikovaolga.
Стек
- Rancher
- HAProxy
- Prometheus
- IPsec
- Python
- Docker