
Site Reliability Engineer (SRE-инженер)
Рунити
Санкт-Петербург
🏢 Офис
Junior
Полная занятость
Описание вакансии
Мы ищем SRE-инженера, который будет отвечать за доступность, стабильность и наблюдаемость платформы облачного провайдера Рег.облако.
Чем предстоит заниматься
•Мониторинг инфраструктуры и сервисов платформы
•Реагирование на алерты, диагностика и устранение инцидентов
•Развитие метрик, дашбордов, логирования и распределённой трассировки
•Повышение доступности, стабильности и отказоустойчивости платформы
•Автоматизация рутинных операций и процессов эксплуатации
•Анализ причин сбоев и предотвращение повторных инцидентов
Что мы ожидаем
•Опыт работы с Kubernetes
•Опыт работы с системами мониторинга VictoriaMetrics или Prometheus
•Понимание принципов построения отказоустойчивых систем
•Навыки диагностики проблем в инфраструктуре и приложениях
•Опыт работы с автоматизацией
Будет здорово, если
•Есть опыт работы с Infrastructure as Code
•Знаешь Golang или есть желание изучать его в процессе работы
Стек технологий
•Kubernete
•Pulumi
•Ansible
•VictoriaMetrics
•Loki
•Jaeger
•Golang
•OpenStack — используется как инфраструктурная платформа. Мы выступаем потребителем сервиса и не занимаемся эксплуатацией или мониторингом самого OpenStack
Мы предлагаем
•Официальное оформление по ТК РФ
•График работы: понедельник – пятница
•Удаленный формат работы на территории РФ. При желании можно посещать наши классные офисы в Москве, Санкт-Петербурге и Самаре
•Льготы аккредитованной IT компании
•ДМС с первого месяца работы
•Wellbeing-программа, включающая консультации с психологами, юристами, финансовыми экспертами, а также онлайн-занятия с фитнес-тренерами
•Возможность пользоваться услугами компании бесплатно: домены, хостинг, SSL
•Современную технику для работы
•Внутрикорпоративное внешнее обучение
