Наши требования
Высшее законченное техническое образование
Опыт работы в качестве Data Engineer/Data Analyst/ETL Developer не менее 2-х лет
Знание SQL на продвинутом уровне: аналитические функции, подзапросы, хранимые процедуры, оптимизация производительности
Опыт работы с большими объемами данных с использованием систем Hadoop, GreenPlum, Oracle, Teradata, MS SQL
Умение работать как самостоятельно, так и в команде
Знание принципов построения распределенных систем хранения и обработки данных
Понимание принципов работы Spark кластера на базовом уровне (драйвер, executors, партиционирование данных, влияние этого на производительность)
Опыт построения витрин/пайплайнов в PySpark (batch-процессы, обновление витрин, работа с большим объемом данных)
Навыки работы с генеративными AI-моделями, опыт создания AI-агентов и использования их в работе