Python-разработчик (AI Evaluation)

Москва
🏢 Офис
Middle
Полная занятость
Россия
Описание вакансии

Ищем Python-разработчика в команду AI. Предстоит разрабатывать систему оценки качества AI-агентов: оценка агентских траекторий и достижения целей, управление и создание (в том числе автоматическое\автоматизированное) тестовых сценариев, автоматизировать сбор и обработку обратной связи, помогать делать агентные системы надежнее.

Задачи
Разрабатывать систему оценки качества AI-агентов
Создавать тестовые сценарии и методики проверки
Разрабатывать метрики качества
Автоматизировать тестирование агентных систем
Анализировать результаты и улучшать процессы контроля качества
Стек технологий
Python, Docker, агентные среды для разработки (Opencode и др.)
Что важно
Опыт коммерческой разработки на Python от 3х лет
Опыт работы с LLM или AI-агентами
Понимание принципов оценки качества AI-систем
Аналитический склад мышления
Будет плюсом
Опыт построения AI Evaluation / LLM Evaluation
Знание CI/CD и автоматизации тестирования
Условия

Гибридный формат: 3 дня в офисе, остальные — удаленно.

Офис рядом с м. Тимирязевская (удобно добираться, есть парковка).

В офисе столовая, тренажерный зал.

Сделаем ДМС после испытательного срока.

Технологии и навыки
AI-помощник
ИсточникСкрыто
Опубликовано1 дн назад
Мы против мошенников на площадке: если тебя просят заплатить, продиктовать код или установить непонятное приложение — прекращай общение и сразу пиши нам (чат с основателем или форма обратной связи).