Design and implementation of a fault-tolerant auto-scalable service infrastructure capable of receiving and processing more than 2 million images per minute using modern GPUs
Automation and support of the existing distributed infrastructure of the service, located in more than 10 regional data centres
Provision and optimization of the internal operational interaction of services with each other
Setting up systems for monitoring the status of services (hundreds of high-performance servers with autoscaling up to 8 thousand servers), collecting and processing logs (up to 200 thousand records per second), collecting and storing statistics, CI, CD
Development of an emergency response strategy for a denial of service in one or more regions
Confident knowledge: Linux, Docker
Expert knowledge of TCP / IP, DNS, HTTP, HTTPS
Experience in building production systems using IaaS: GCP or AWS
Knowledge of modern methods of trouble-free operation of highly loaded network applications
Knowledge of Python, Bash
Skills of writing scripts for interacting with the API
Experience with Terraform, Ansible, ElasticSearch (ELK), operation Clickhouse cluster, Concourse CI/CD
Above market wages, formal employment and white wages
Cozy office with sea view
Health insurance
Compensation of costs for professional literature
Sports compensation
Compensation for the purchase of a mobile phone (once a year, 50% of the cost is compensated)
Flexible start of the working day
Relocation to Cyprus (Limassol) is required for this role
Comfortable working conditions, a positive atmosphere, an open, informal corporate culture, and a friendly team
An excellent opportunity, together with a professional team, to solve interesting and complex problems, to create a product that is used by millions of people
TOP-приложение в 154 странах для iOS и в 99 странах для Android (включая США, Великобританию, ЕС, Бразилию, страны Юго-Восточной Азии)
Приложение года в AppStore и Google Play
Передовые технологии в редактировании фото
Проектирование и внедрение отказоустойчивой, автоматически масштабируемой инфраструктуры сервиса, способной принимать и обрабатывать более 2 миллионов изображений в минуту с использованием современных графических процессоров (GPU)
Автоматизация и поддержка существующей распределенной инфраструктуры сервиса, расположенной в более чем 10 региональных дата-центрах
Обеспечение и оптимизация внутреннего операционного взаимодействия сервисов друг с другом
Настройка систем для мониторинга состояния сервисов (сотни высокопроизводительных серверов с автоматическим масштабированием до 8 тысяч серверов), сбор и обработка логов (до 200 тысяч записей в секунду), сбор и хранение статистики, обеспечение CI/CD процессов
Разработка стратегии экстренного реагирования в случае отказа сервиса в одном или нескольких регионах
Уверенные знания: Linux, Docker
Экспертное знание TCP/IP, DNS, HTTP, HTTPS
Опыт построения продакшн-систем с использованием IaaS: GCP или AWS
Знание современных методов бесперебойной работы высоконагруженных сетевых приложений
Знание Python, Bash
Навыки написания скриптов для взаимодействия с API
Опыт работы с Terraform, Ansible, ElasticSearch (ELK), Clickhouse, Concourse CI/CD
Зарплата выше рыночной, официальное трудоустройство и "белая" зарплата
Уютный офис с видом на море
Медицинская страховка
Компенсация затрат на профессиональную литературу и спорт
Компенсация покупки мобильного телефона (раз в год, компенсируется 50% стоимости)
Гибкий график начала рабочего дня
Необходим переезд на Кипр (Лимассол)
Комфортные условия работы, позитивная атмосфера, открытая, неформальная корпоративная культура и дружный коллектив