Über die Stelle
Ищут hands-on руководителя платформенной команды, который будет совмещать техническое лидерство, развитие инженеров и активную работу над платформой. Основной фокус роли — создание единых инженерных подходов, переиспользуемых решений и SRE-практик.
О компании и продукте
Продуктовая iGaming-компания с высоконагруженной инфраструктурой и частыми релизами проходит трансформацию из быстрорастущего стартапа в зрелую инженерную организацию.
В команде разработки более 30 человек, продукт переходит на новую архитектуру.
Основные задачи
Около 30% времени — развитие команды, около 70% — развитие платформы.
- Развивать инженеров через регулярную обратную связь, менторинг и индивидуальные планы развития
- Участвовать в найме и формировании сильной платформенной команды
- Определять технические стандарты и контролировать их соблюдение
- Управлять приоритетами между запросами продуктовых команд и развитием платформы
- Формировать и реализовывать roadmap развития платформы
- Развивать golden paths и переиспользуемые модули на Terraform и Helm для быстрого запуска сервисов
- Развивать и поддерживать платформу на базе AWS и Kubernetes
- Развивать CI/CD как платформенный продукт: единые шаблоны GitLab CI и GitOps-подход к деплою
- Развивать observability с использованием Prometheus, Grafana, Loki, Alertmanager и distributed tracing
- Развивать сетевую архитектуру и безопасность: VPC, VPN, балансировка нагрузки и управление секретами
- Внедрять SRE-практики: SLO, error budgets и эффективный on-call процесс
- Сокращать time-to-production и снижать когнитивную нагрузку на команды разработки
Что ожидают от кандидата
- Опыт руководства командой DevOps, SRE или Platform Engineers
- Практический опыт работы с AWS: EKS, RDS, VPC, IAM, S3
- Опыт эксплуатации Kubernetes в production: Helm, Ingress, StatefulSets, Operators
- Ежедневная работа с Terraform, Ansible и Helm
- Опыт построения CI/CD с GitLab CI или аналогами и понимание GitOps-подхода
Будет преимуществом
- Практический опыт GitOps: ArgoCD, Flux
- Знание OpenTelemetry и distributed tracing
- Опыт работы с решениями для управления секретами: Vault, SOPS, AWS Secrets Manager
- Зрелые SRE-практики: SLO, error budgets и построение on-call процессов
- Опыт FinOps в AWS
- Опыт работы со stateful-сервисами в Kubernetes: PostgreSQL, Kafka, Redis и операторы
Условия
- Полная занятость
- Удалённая работа из любой точки мира
- Гибкое начало рабочего дня
- Оформление по Service Agreement
- 20 рабочих дней отпуска в год
- Полностью оплачиваемый больничный