Сильный Python и опыт разработки batch / data processing pipelines
Опыт backend, data engineering или software engineering для внутренних платформ и ML/data workflows
Опыт работы с большими файлами, metadata manifests, reproducible builds и validation logic
Практический опыт с Linux, Docker, Git, CI/CD и командной строкой
Понимание storage и data formats: S3/object storage, network storage, parquet, zarr, hdf5, webdataset, video files или аналогичные форматы
Умение разбираться в нестандартных форматах данных и приводить их к строгому контракту
Готовность писать поддерживаемый production-like код, а не одноразовые conversion scripts
Опыт с LeRobot, RLDS, DROID / Bridge / RT-X-like datasets, ROS bags или robotics trajectories
Опыт с Ray, Airflow, Prefect, Kubernetes, SLURM, LSF или другими orchestration / job systems
Опыт с W&B, MLflow, Hydra configs, experiment tracking или dataset management systems
Понимание computer vision, multimodal data, VLA, imitation learning или robot learning
Навыки работы с генеративными AI-моделями
Опыт создания AI-агентов и использования их в работе будет преимуществом
Опыт использования GigaChat, Kandinsky и аналогов в продуктах, навыки создания и использования AI-агентов
Инструментальное владение AI для анализа, генерации и автоматизации