Sobre la vacante
Специалист будет работать с машинным обучением, большими данными и ML-пайплайнами для корпоративных решений.
Условия
- Удалённая работа
О компании
Haulmont развивает популярную во всем мире Open Source платформу Jmix для разработки корпоративного ПО и создаёт решения для автоматизации бизнеса заказчиков.
Требования
- Практический опыт в ML или Data Science не менее 3 лет
- Глубокая экспертиза в gradient boosting: CatBoost, XGBoost или LightGBM; тюнинг гиперпараметров, регуляризация, работа с категориальными признаками, масштабирование на GPU и CPU
- Уверенный Python для продакшн-ML: pandas, NumPy, SciPy, scikit-learn
- Опыт построения и валидации ML-пайплайнов на больших данных от 100K объектов
- Сильный фичеинжиниринг на табличных и временных данных
- Опыт оптимизации и распараллеливания ML-вычислений: multiprocessing, Dask, Spark, Ray
- SQL на уровне работы с большими таблицами: joins, window-функции, оптимизация запросов
- Понимание статистики: A/B-тесты, доверительные интервалы, проверка гипотез
- Знание оптимизационных методов
- Опыт применения трансформеров будет плюсом
- Знание MLOps: Airflow или Prefect, MLflow, мониторинг дрейфа — будет плюсом
- Опыт в домене ритейла, ценообразования или программ лояльности будет плюсом