Наши требования
Опыт работы с Iceberg,DataHub/OpenMetaData,SODA/GreateExpectation, ClickHouse,Kubernetes
Навыки работы с генеративными AI-моделями
Опыт создания AI-агентов и использования их в работе
Высшее образование
Опыт работы data engineer от 5 лет
Глубокое понимание принципов модели распределённых вычислений
Уверенные навыки поиска, обработки данных и построения витрин с помощью Spark и SQL
Опыт промышленной разработки на стеке Scala/Java/Python, знание инструментов по обработке больших данных (Spark, Trino, Polars) и опыт работы со стримингом (Flink, Spark Streaming, Kafka)
Продвинутые знания SQL и практический опыт работы с одной из реляционных СУБД (Oracle, PostgreSQL, mySQL, MS SQL Server), а также работа с объектными хранилищами S3 и файловой системой HDFS
Знание любого оркестратора рабочих процессов (AirFlow, Oozie, Dagster, Argo Workflows) и понимание подходов к организации разработки (CI/CD, DevOps)