Вакансия жөнүндө
Команда ищет Site Reliability Engineer уровня Middle+ / Senior для поддержки, развития и наблюдаемости legacy-инфраструктуры. Роль предполагает работу с сетями, балансировщиками, контейнерной средой, мониторингом и low-level production-проблемами.
О компании и проекте
Международная логистическая компания GBS. Проект связан с поддержкой и развитием legacy-инфраструктуры на базе Rancher 1.6, IPsec mesh и HAProxy.
Задачи
- Поддерживать и развивать инфраструктуру на Rancher 1.6, включая контейнеризацию и управление окружениями
- Работать с IPsec mesh и overlay-сетями: диагностировать, оптимизировать и повышать отказоустойчивость
- Настраивать и тюнить HAProxy L4/L7 в связке с контейнерной средой
- Разрабатывать на Python инструменты автоматизации и наблюдаемости
- Строить мониторинг на Prometheus: создавать кастомные метрики и алерты, собирать данные с legacy-компонентов
- Проводить troubleshooting production-инцидентов без готовых алертов
- Работать с PostgreSQL и RabbitMQ
- Писать документацию и runbook’и для типовых проблем
Требования
- Опыт работы в DevOps / SRE от 4 лет
- Уверенная практическая работа с Docker и контейнерами
- Опыт работы с HAProxy или аналогичными L7/L4-балансировщиками, включая настройку, релоады и debugging
- Опыт работы с Prometheus, включая написание кастомных экспортеров и метрик
- Глубокое понимание сетей: TCP/IP, VPN, особенно IPsec, overlay и маршрутизация
Условия
- Полная занятость
- Гибридный формат; удалённая работа возможна через 3 месяца
- Локация: Москва
- Заработная плата: от 250 000 до 400 000 рублей gross в зависимости от уровня
- Реальные задачи с высокой инженерной сложностью
- Минимум бюрократии и максимум самостоятельности
Отклик
Для отклика свяжитесь с Olga Veretennikova в Telegram: @veretennikovaolga.