WorkaemКарьерная платформа
  • Вакансии
  • Компании
  • Зарплаты
  • Что спрашивают
  • Сервисы
  • Блог
  • Работодателям
Workaem

Карьерная платформа для IT-специалистов: вакансии напрямую с карьерных страниц 300+ компаний, из телеграм-каналов, с международных площадок и от работодателей напрямую. Разбор условий, детектор мёртвых вакансий, AI-инструменты для резюме. Базовые функции бесплатны.

Подпишись, присылаем лучшие вакансии недели
Или читай канал в телеграме
Соискателям
Все вакансииЗа границейУдалёнка в долларахКомпании с РУ основателямиЗарплатыТренды рынкаОфферыВопросы с собеседованийВозможностиИИ-инструментыПроверка резюме без входаСоветыСоздать резюмеТренировка интервьюИгра «Путь джуна»
По технологиям
Вакансии PythonВакансии JavaScriptВакансии ReactВакансии JavaВакансии GoВакансии Docker
По профессиям
РазработкаДизайнQA / ТестированиеАналитикаProduct / Project ManagerМаркетинг
Работодателям
Разместить вакансиюТарифыБаза кандидатовСвязаться с нами
Кабинет
РегистрацияВойтиЛичный кабинетМои откликиСохранённыеУведомления
Компания
О проектеПредложенияКонтактыБлогКонфиденциальностьУсловия использования
© 2026 Workaem. Все права защищены.КонфиденциальностьУсловияОферта
Made by IT, for IT 💛
Senior MLOps/DevOps Engineer (LLM)
ВердиктОписаниеИнструментыКомпанияПохожие
  1. Главная
  2. /
  3. Вакансии
  4. /
  5. Senior MLOps/DevOps Engineer (LLM)

Сбер·Москва (Кутузовская)·17 июня

Senior MLOps/DevOps Engineer (LLM)

300 000 – 500 000 ₽
на 50% выше медианы рынка
≈ 3,5 тыс.–5,8 тыс. $
🔄 ГибридSeniorПолная занятость
300 000 – 500 000 ₽≈ 3,5 тыс.–5,8 тыс. $
Навык востребован (Python). Но верх вилки на 20% ниже медианы грейда.
Нажмите на сигнал, чтобы увидеть, на чём он основан

Описание вакансии

Мы строим платформу для инференса и SFT open-source LLM. Используем продвинутые cutting-edge движки для инференса, много экспериментируем и боремся за каждую дополнительную единицу в Token throughput. Cейчас мы находимся в поиске MLOps-инженера, который вместе с нами продолжит настраивать и улучшать инфраструктуру инференса LLM-моделей и осуществлять вывод решений в прод контур.

Первый этап отбора на эту вакансию — общение с AI-рекрутером. После отклика вам на почту и в чат на платформе HeadHunter придет приглашение пройти первичное интервью с ГигаРекрутером в Telegram. Диалог займёт примерно 10 минут. Его задача — уточнить недостающие детали и ускорить рассмотрение вашей кандидатуры. ГигаРекрутер только начинает свой путь, поэтому просим относиться с пониманием. Ваш опыт и участие помогут сделать его удобным и полезным!

Вам предстоит
Разрабатывать и оптимизировать инфраструктуру инференса LLM-моделей для минимальной задержки и высокой пропускной способности внутренних приложений и сервисов.
Обеспечивать масштабируемость и надежность LLM-serving инфраструктуры; выбирать и настраивать инструменты для инференса (sglang, vLLM, llama.cpp).
Разрабатывать механизмы разграничения доступов к API-сервисам моделей.
Строить систему observability и мониторинга LLM-инференса.
Собирать модели в сервисы и интерфейсы (FastAPI, Flask, Tornado, Streamlit, Chainlit и т.д.).
Мы ожидаем
Опыт в аналогичной роли от 5 лет.
Опыт с Linux (сеть, storage, роли/пользователи, менеджмент процессов).
Уверенное владение Kubernetes (используем Istio Service Mesh).
Опыт построения высокопроизводительных LLM-сервисов (sglang, vLLM).
Опыт настройки высоконагруженных прокси-серверов (nginx, Envoy, HAProxy): load balancing, rate limiting, SSL termination, health checks.
Владение языками: Bash, Python, Groovy (Jenkins scripted).
Продвинутые навыки в CI/CD и оркестрации моделей.
Будет преимуществом
Понимание распределенных систем и GPU-коммуникации (NCCL, MPI, RDMA, InfiniBand).
Знание служебных компонентов LLM-пайплайна: токенизаторы, KV-cache, контекстное окно.
Понимание внутренней архитектуры GPU (CUDA, cuDNN, Tensor Cores).
Опыт работы с векторными БД (Opensearch, Qdrant, FAISS, pgvector) для RAG и других задач.
Мы предлагаем
Гибридный формат работы (2-3 дня в офисе).
Годовой бонус и ежегодный пересмотр.
Расширенный ДМС с первого дня + стоматологию и льготное страхование для семьи.
Корпоративный университет Сбера, внутреннюю образовательную платформу, участие в IT-конференциях.
Офис на Кутузовской с зонами отдыха и спортзалом.
Льготную ипотеку в Сбере, корпоративную пенсионную программу, подписку СберПрайм+, скидки от партнеров и сервисов группы компаний.

Технологии и навыки

Linux
Kubernetes
Envoy
HAProxy
Bash
Python
Groovy
Nginx
CI/CD
Jenkins
Сбер
Сбер
Москва (Кутузовская)

ГрейдSenior
ЗанятостьПолная занятость
РегионРоссия
ФорматГибрид
ИсточникСкрыто
Опубликовано17 июня
Все вакансии компании

AI-помощник

под эту вакансию
Войди, чтобы AI оценил твоё соответствие вакансии и написал сопроводительное письмо

Похожие вакансии

Java разработчик (Кликстрим)ПАО Сбербанкдо 340 000 ₽Python-разработчик (Agent Execution Framework)ПАО СбербанкИнженер сопровождения в команду аналитической отчётностиПАО СбербанкВедущий инженер по сопровождению (Antifraud)ПАО Сбербанк
Мы против мошенников на площадке: если тебя просят заплатить, продиктовать код или установить непонятное приложение, прекращай общение и сразу пиши нам (чат с основателем или форма обратной связи).