Vakansiya haqqında
Команда развивает GigaChat Reasoning и ищет специалиста по reinforcement learning для повышения качества модели и эффективности обучения.
Чем предстоит заниматься
- Улучшать качество работы GigaChat Reasoning на русском и английском языках
- Ускорять пайплайн обучения
- Тестировать новые Loss-функции и подходы к обучению
Что мы ожидаем
- Знание Python