О роли
Проектирование и разработка отказоустойчивых ETL/ELT процессов в экосистеме Hadoop и OracleОптимизация и сопровождение пайплайнов данных (Spark, PySpark, Airflow)Интеграция новых источников данных и построение витрин для бизнес-заказчиковОбеспечение качества и актуальности данных в продуктивных системахУчастие в архитектурных решениях по хранению и обработке больших данныхAd-hoc аналитика и поддержка команд аналитиков и data scientist