Чем предстоит заниматься
Поддержка и эксплуатация: Обеспечение стабильной работы и доступности инфраструктуры в промышленных средах 24/7
Оптимизация: Анализ производительности систем, выявление узких мест и реализация мер по повышению отказоустойчивости
Взаимодействие: Тесная работа с командами разработки (для решения архитектурных вопросов, проработки аналитики и тестирования) и администраторами смежных систем для интеграции решений
Управление изменениями: Тестирование обновлений ПО, проведение аудита текущего состояния инфраструктуры, рефакторинг систем для повышения их эффективности
Решение инцидентов: Приоритизация задач, оперативное реагирование на сбои, глубокий анализ причин возникновения ошибок и их устранение
Развитие: Участие в проектах по внедрению новых продуктов и миграции систем на новые платформы
Kubernetes, ArgoCD
Grafana, Victoria Metrics, Opensearch, Vector
PostgreSQL
Ignite
HaProxy/Nginx
Kafka
Java (spring boot), Python