Наши требования
Уверенное владение Python; знание C++ как плюс для интеграции на робота
Опыт применения RL-алгоритмов для робототехники или управления (PPO, SAC и подобные)
Понимание динамики и управления, в идеале — шагающих роботов
Опыт подбора гиперпараметров и cost/reward-функций для RL
Знакомство с типовыми техниками RL: domain randomization, curriculum learning, reward shaping
Опыт работы с симуляторами (MuJoCo, Isaac Sim или аналоги)
Способность самостоятельно разбираться в незнакомых системах и находить корневые причины проблем
Желание брать ответственность за то, что политика работает на роботе, а не только в симуляторе
Опыт деплоя обученных политик на реальное железо
Опыт с behavior cloning и дистилляцией политик
Понимание основ теории управления, кинематики и динамики шагающих роботов
Опыт работы с middleware робота (ROS2, DDS)
Опыт использования GigaChat, Kandinsky и аналогов в продуктах, навыки создания и использования AI-агентов