О позицији
Ищут DevOps/MLOps-инженера уровня middle/senior для поддержки и развития ML-инфраструктуры, Kubernetes-кластеров с GPU-нодами, CI/CD и сервисов инференса.
Чем предстоит заниматься
- Поддерживать и масштабировать Kubernetes-кластеры с GPU-нодами.
- Развертывать и оптимизировать сервисы инференса vLLM и LightLLM.
- Проектировать и улучшать пайплайны в GitLab CI/CD, ускорять сборки.
- Автоматизировать рутинные операции, разрабатывать ботов и агентов для поддержки команды.
- Автоматизировать жизненный цикл ML-моделей: обучение, тестирование, деплой и мониторинг дрейфа данных.
- Настраивать логирование, мониторинг и алертинг на базе Prometheus, Grafana и OpenSearch.
- Администрировать серверы команды, обеспечивать отказоустойчивость и безопасность инфраструктуры.
- Участвовать в разработке, интеграции и деплое автономных агентских систем и LLM-приложений.
Требования
- Коммерческий опыт администрирования Linux и управления производственными кластерами Kubernetes.
- Уверенное владение Helm: написание чартов и управление релизами.
- Продвинутый опыт построения и поддержки пайплайнов CI/CD в GitLab CI/CD или аналогах.
- Понимание принципов безопасности, опыт работы с Keycloak и OAuth2.
- Опыт управления секретами через HashiCorp Vault.
Будет плюсом
- Опыт поддержки и администрирования Big Data-сервисов: Trino, Airflow, ClickHouse, Kafka, Hadoop и Redis.
- Опыт разработки внутреннего тулинга и утилит на Python.
- Опыт оптимизации работы GPU в Kubernetes: device plugins, мониторинг VRAM и планирование задач.
- Знание принципов работы LLM и фреймворков для их обслуживания.
Условия
- Грейд: middle/senior.
- Локация: РФ.
- Работа только через ИП.
Как откликнуться
Писать в директ.