O pozici
Команда ищет Python-разработчика для развертывания, масштабирования и поддержки ML-сервисов в on-premise средах. В роли предстоит развивать ML-инфраструктуру, автоматизировать пайплайны и обеспечивать надежность production-решений.
Чем придется заниматься
- Контейнеризировать ML-модели с использованием Docker и разворачивать их в Kubernetes-кластерах
- Настраивать и управлять оркестрацией ML-пайплайнов через Apache Airflow
- Обеспечивать масштабируемость и отказоустойчивость ML-сервисов в on-premise средах
- Подключать сервисы к системам мониторинга и журналирования
- Анализировать и устранять инциденты в работе ML-сервисов на третьей линии поддержки
- Оптимизировать использование вычислительных ресурсов и настраивать автомасштабирование рабочих нагрузок
- Разрабатывать интеграции между ML-сервисами через REST API и Kafka
- Создавать автоматизированные пайплайны для обработки данных, feature engineering и тестирования моделей
- Внедрять Infrastructure as Code подходы для управления ML-инфраструктурой
Требования и навыки
- Глубокое владение Python от 3 лет с пониманием принципов написания production-ready кода
- Опыт работы с Docker и Kubernetes для развертывания ML-моделей
- Уверенное владение Apache Airflow для оркестрации ML-пайплайнов
- Понимание построения CI/CD-пайплайнов для ML-решений с использованием GitLab CI или GitHub Actions
- Навыки работы с системами мониторинга Prometheus и Grafana
Условия работы
- Удаленная работа
Компания
Т1
Отклик
Откликнуться можно через страницу вакансии: https://career.t1.ru/vacancies/vacancy-detail?id=130487699