O pozícii
Ищут QA-инженера уровня Middle / Middle+ для тестирования LLM и AI-агентных систем. Роль предполагает работу с поведением агентов, eval-наборами, автоматизацией и качеством ответов моделей.
Задачи
- Тестировать поведение AI-агентов: диалоги, логику, контекст и состояние
- Выявлять и анализировать галлюцинации, отклонения от инструкций и логические ошибки
- Разрабатывать и поддерживать тест-кейсы для LLM-агентов в ручном и автоматизированном режиме
- Строить и поддерживать eval-наборы (Golden Datasets) для регрессионного тестирования