Чем предстоит заниматься
Развивать BigData слой, который готовит данные для ML и аналитики рекомендаций из >1 миллиарда событий в месяц. Слой включает в себя как задачи по расписанию (даги в Airflow), так и spark-стриминги
Разрабатывать сервис нечеткого поиска (fuzzy search), в том числе проектировать логику АБ-тестирования, улучшать мониторинг алгоритмов
Разрабатывать сервис для работы LLM-ассистентов в продакшене, в том числе инструментов для отладки ассистентов в live-режиме
Интегрироваться с внешними сервисами скоринга материалов и их фича-сторами.
Cтек: Kafka, Hadoop, Hive, Spark, Clickhouse, Python, Go, Docker, PostgreSQL, Redis, Java, Elasticsearch, Prometheus, Graphite, Sentry, Grafana, Superset, Linux, Docker, GitlabCI