Наши требования
Опыт работы Data Engineer от 2–3 лет
Уверенное владение Apache Spark (версии 2.x или 3.x). Обязательно знание Scala как основного языка разработки трансформаций
Глубокое понимание архитектуры экосистемы Hadoop (YARN, HDFS, Hive Metastore)
Экспертный уровень SQL: свободное использование оконных функций (ROW\_NUMBER, RANK, LAG/LEAD), сложных джоинов и вложенных запросов
Навык анализа требований бизнеса и перевода их на язык технических спецификаций
Практический опыт расследования и устранения последствий инцидентов L3 в продуктивной среде больших данных
Самостоятельность: умение декомпозировать задачу, оценить сроки и довести ее до релиза без микроменеджмента
Знакомство с инструментами _DevOps_ и практиками CI/CD применительно к доставке Spark-приложений
Будет плюсом: опыт использования AI-инструментов в разработке (LLM-ассистенты для написания и ревью кода, агенты для автоматизации рутинных операций, инструменты автодополнения вроде GitHub Copilot)
Опыт работы с данными в финансовом секторе, ритейле или телекоме; знакомство со специфическими юридическими источниками
Навыки работы с генеративными AI-моделями