Informazioni sull'offerta
Mirantis ищет Principal HPC Network Engineer для технического руководства высокопроизводительными сетевыми средами, поддерживающими крупномасштабную HPC- и AI/ML-инфраструктуру. Роль предполагает архитектуру, развертывание, оптимизацию и устранение неполадок в сетях InfiniBand и Ethernet.
О компании
Mirantis — глобальная компания, развивающая инфраструктуру с открытым исходным кодом, Kubernetes-, cloud-native- и AI-инфраструктурные платформы. Компания работает с клиентами в 90 странах и помогает организациям развертывать и эксплуатировать GPU-инфраструктуру в on-premises, cloud, hybrid и edge-средах.
Чем предстоит заниматься
- Проектировать, развертывать и эксплуатировать высокопроизводительные сети для HPC- и AI-кластеров
- Отвечать за архитектуру и оптимизацию сетей InfiniBand
- Управлять коммутаторами, HCA, менеджерами подсетей и конфигурациями сетевой фабрики
- Устранять сложные проблемы с задержками, пропускной способностью, маршрутизацией и подключением в средах InfiniBand и Ethernet
- Руководить настройкой производительности, мониторингом и планированием емкости
- Развертывать и поддерживать решения Fortinet, включая FortiGate, FortiManager и FortiAnalyzer
- Взаимодействовать с командами compute, storage и platform для поддержки работы кластеров
- Руководить эскалациями критических инцидентов, обновлениями сетей, миграциями и новыми развертываниями
- Определять сетевые стандарты, операционные процедуры и техническую документацию
Что мы ожидаем
- Глубокий практический опыт работы с InfiniBand, желательно с решениями Mellanox/NVIDIA
- Сильная экспертиза в сетевых технологиях TCP/IP, BGP, OSPF, VLAN, QoS и сетевой архитектуре
- Опыт поддержки HPC-, дата-центровой или крупномасштабной AI/ML-инфраструктуры
- Практический опыт работы с продуктами Fortinet и настройки межсетевых экранов
- Знание RDMA, MPI и концепций низколатентных сетей
Условия
- Локация: EU, удаленный или гибридный формат
- Занятость: full-time
- Компенсация гибкая и зависит от опыта и места найма
Почему Mirantis
- Работа с передовой инфраструктурой NVIDIA, InfiniBand, HPC и AI, а не с обычными корпоративными сетями
- Техническая ответственность за архитектуру, производительность и надежность
- Решение сложных производственных проблем, где дизайн сети напрямую влияет на утилизацию GPU и производительность AI-нагрузок
- Влияние на стандарты, инструменты и будущие развертывания инфраструктуры
- Работа между командами networking, compute, storage, Kubernetes и AI platform
Как откликнуться
Отправьте в личном сообщении LinkedIn-профиль или CV контакту @Yuliana_S_22. После этого будут предоставлены дополнительные детали.