Over de vacature
Ищут QA-инженера уровня Middle / Middle+ для тестирования LLM и AI-агентных систем. Работа включает проверку поведения агентов, оценку качества ответов и развитие тестовой архитектуры.
Задачи
- Тестировать поведение AI-агентов: диалоги, логику, контекст и состояние
- Выявлять и анализировать галлюцинации, отклонения от инструкций и логические ошибки
- Разрабатывать и поддерживать тест-кейсы для LLM-агентов в manual- и automation-подходах
- Строить и поддерживать eval-наборы (Golden Datasets) для регрессионного тестирования