Чем предстоит заниматься
Формировать и приоритизировать бэклог платформенных инструментов для оценки качества агентов и удобства их разработки
Развивать продуктовые направления вокруг LLM-as-a-Judge, универсальных агентов, памяти, скиллов и безопасной среды исполнения
Развивать продуктовые возможности для команд разработки агентов: evals, наблюдаемость, эксперименты, удобство интеграции и эксплуатации
Собирать обратную связь от внутренних команд-пользователей и переводить её в понятные требования, сценарии и критерии готовности
Определять метрики продукта и критерии качества, полезности и зрелости платформенных функций
Координировать delivery между разработкой, аналитикой, data-командой, инфраструктурой и пользователями платформы
Прорабатывать гипотезы по новым инструментам и функциям, которые ускоряют создание агентов и повышают их качество в промышленном контуре
Готовить и проводить презентации для внутренних стейкхолдеров: демонстрация прогресса, обоснование приоритетов, защита продуктовых решений