Яндекс·Москва·12 сент.
Бэкенд-разработчик в команду надёжности Маркета
Ориентир по рынку≈ 150 000 – 350 000 ₽наша приблизительная оценка по 148 вакансиям этой роли и грейда, у работодателя вилка не указана
🔄 ГибридMiddleПолная занятостьКорпорация
61
Хорошие условия
За такой навык на рынке платят больше, работа расписана подробно. Но вилки нет, про деньги придётся договариваться с нуля.
Наша компания
Привет! Я Ксюша, руковожу командой надёжности и инструментов разработки в Маркете. Мы делаем так, чтобы разработчикам было легко писать стабильные сервисы и за минуты проверять свои изменения в максимально приближённом к проду контуре — Hamster. У нас амбициозные планы покрыть Hamster всё многообразие сервисов Маркета, для чего не обойтись без продвинутого использования ИИ и готовности разбираться с устройством всего и вся. Ждём бэкендеров, которые не готовы довольствоваться знанием только своих сервисов и хотят делать самую удобную инфраструктуру! Ксения Лукашевичус
О роли
Руководитель службы надёжности и инструментов разработки Яндекс Маркет — это сотни бэкенд-сервисов на C++ и Java, которые вместе собирают витрину, корзину, чекаут, промо и партнёрские инструменты. Десятки команд каждый день выкатывают в них изменения, и цена ошибки — просевшие заказы и деньги. Наша команда делает так, чтобы разработчикам было легко писать стабильные сервисы и безопасно проверять и
Чем предстоит заниматься
Довести Hamster от MVP до инструмента production-ready для всего Маркета
Сейчас Hamster покрывает ограниченное количество сервисов, и многое в нём на ручном приводе. Предстоит раскатить его на весь Маркет: сделать так, чтобы сервис на любой из наших платформ (фреймворк C++ userver, Java/Kotlin, графовые сервисы) подключался автоматически, а не через полуручную сборку конфигов, доступов, мониторингов и роутинга. Когда инструментом пользуются сотни разработчиков, он сам становится продакшеном, поэтому также предстоит работать над наблюдаемостью и стабильностью Hamster как системы
У нас много архитектурных задач: необходимо продумывать, как связать бета-версии, роутинг трафика, деплой и безопасность, чтобы у разработчика всё завелось по кнопке. Кодогенерация и автоматики в основном на Python, спецификации — на разных языках описания
Развивать инструменты инцидент-менеджмента
Мы отвечаем за то, чтобы инцидент замечали за минуты, чинили быстро и разбирали честно. Предстоит развивать бот, сервисы автоматизации на Python, дашборды и интеграции с трекером задач и внутренней платформой инцидентов: модель приоритетов с автоматической эскалацией, SLA на реакцию и разбор, SLO-алерты, тиры критичности сервисов
Цель — поставить на поток улучшение через инциденты: чтобы из разбора рождались действия и рецидивы находились автоматически
Повышать стабильность сервисов за счёт предотвращения инцидентов
Помимо Hamster, есть и другие способы не доводить проблемы до продакшена: покрывать сервисы проверенными алертами, проводить тестирование на поиск нежелательных зависимостей между сервисами, внедрять всем CI с нужными этапами проверок и многое другое. Здесь есть много векторов работы, которая окажет влияние на весь Маркет
Больше о бэкенде в Яндексе — в канале Yandex for Backend
Наши требования
Разрабатывали бэкенд не менее 3–4 лет
Эксплуатировали сервисы под нагрузкой: дежурили, разбирали инциденты
Уверенно пишете на Python и имеете бэкграунд в C++ или Java (или наоборот: сильны в C++/Java и свободно пишете на Python)
Понимаете, как устроены распределённые системы: балансировка, роутинг трафика, деплой, контейнеры, мониторинг и алертинг
Умеете продумывать архитектуру: связать между собой несколько систем так, чтобы получился работающий инструмент
Готовы много общаться со смежными командами: выяснять потребности, договариваться, доводить изменения в чужих сервисах до конца
Активно используете ИИ-инструменты и агентов в работе и хотите строить на них продукты
Работали с фреймворком C++ userver или другими асинхронными фреймворками для микросервисов
Строили тестовые или предпродовые окружения, канареечные выкладки, зеркалирование трафика
Настраивали L7-балансировщики и понимаете сетевой стек
Писали инструменты для разработчиков: боты, CI-пайплайны, кодогенерацию, внутренние админки
Строили агентные ИИ-пайплайны и скиллы для LLM
Работали в e-commerce и понимаете, как инцидент превращается в потерянные заказы
Знакомы с практиками SRE: SLO, бюджет ошибок, MTTA/MTTR, эскалации
Хотите расти до тимлида: у нас есть такая возможность, если это вам интересно