WorkaemКарьерная платформа
  • Вакансии
  • Компании
  • Зарплаты
  • Офферы
  • Сервисы
  • Блог
  • Работодателям
Workaem

Карьерная платформа для IT-специалистов: вакансии напрямую с карьерных страниц 300+ компаний, из телеграм-каналов, с международных площадок и от работодателей напрямую. Разбор условий, детектор мёртвых вакансий, AI-инструменты для резюме. Базовые функции бесплатны.

Подпишись, присылаем лучшие вакансии недели
Или читай канал в телеграме
Соискателям
Все вакансииЗа границейУдалёнка в долларахКомпании с РУ основателямиЗарплатыОфферыВозможностиСоветыСоздать резюмеТренировка интервью
По технологиям
Вакансии PythonВакансии JavaScriptВакансии ReactВакансии JavaВакансии GoВакансии Docker
По профессиям
РазработкаДизайнQA / ТестированиеАналитикаProduct / Project ManagerМаркетинг
Работодателям
Разместить вакансиюТарифыБаза кандидатовСвязаться с нами
Кабинет
РегистрацияВойтиЛичный кабинетМои откликиСохранённыеУведомления
Компания
О проектеПредложенияКонтактыБлогКонфиденциальностьУсловия использования
© 2026 Workaem. Все права защищены.КонфиденциальностьУсловияОферта
Made by IT, for IT 💛
Middle AI Guardrails Developer (Platform V AI Guardrails)
ВердиктОписаниеИнструментыКомпанияПохожие
  1. Главная
  2. /
  3. Вакансии
  4. /
  5. Middle AI Guardrails Developer (Platform V AI Guardrails)

SberTech·Москва·5 дн назад

Middle AI Guardrails Developer (Platform V AI Guardrails)

🏢 ОфисMiddleПолная занятость
Зарплата не указана
56
Есть о чём спросить
Навык востребован (Python), за такой навык на рынке платят больше. Но вилки нет, про деньги придётся договариваться с нуля.
Нажмите на сигнал, чтобы увидеть, на чём он основан

Наша компания

Мы разрабатываем системы безопасности и контроля для LLM и генеративных AI-моделей. Наша цель — создавать надёжные guardrails, которые предотвращают нежелательное поведение моделей, токсичный контент, jailbreak-атаки, утечки данных и нарушения политик, сохраняя при этом полезность и качество ответов. Мы ищем сильного специалиста в команду разработки. Человек будет не просто писать код, а глубоко понимать предметную область: проектировать и развивать защитные механизмы вокруг LLM, проводить активную аналитику собственного решения и решений конкурентов, выявлять слабые места и предлагать улучшен

Чем предстоит заниматься

Разрабатывать и улучшать компоненты AI Guardrails: фильтры контента, системы детекции токсичности, bias, PII, jailbreak-попыток, prompt injection и других рисков
Интегрировать и дообучать модели классификации / модерации (toxicity, hate speech, self-harm, sexual content и др.)
Проектировать и реализовывать пайплайны pre-/post-processing для LLM (input/output filtering, rewriting, refusal mechanisms)
Создавать и поддерживать evaluation-фреймворки: бенчмарки, red-teaming, adversarial testing, метрики безопасности и robustness
Работать с LLM API / open-source моделями, оптимизировать latency и качество guardrails
Участвовать в разработке политик безопасности, документировать решения
Анализировать инциденты, улучшать покрытие edge-cases и снижать false positive/negative

Наши требования

2–4+ года коммерческого опыта в ML/AI-разработке (Python)
Опыт работы с LLM (OpenAI, Anthropic, open-source: Llama, Mistral, Qwen и т.д.)
Практический опыт построения систем модерации / content safety / guardrails или похожих задач (toxicity detection, PII redaction, prompt defense)
Хорошее знание NLP: классификация текста, embeddings, fine-tuning (LoRA/QLoRA), evaluation
Опыт с PyTorch / Hugging Face Transformers, LangChain / LlamaIndex / аналогичными фреймворками
Понимание основных угроз LLM (jailbreaks, prompt injection, data leakage, hallucination risks)
Умение писать чистый, тестируемый код, работать с CI/CD, Docker
Самостоятельность и ownership: способность брать задачу end-to-end (от исследования до production)
Навыки работы с генеративными AI-моделями
Опыт red-teaming / adversarial ML / safety evaluation
Знание техник alignment (RLHF, DPO, constitutional AI) и safety benchmarks (HarmBench, JailbreakBench, AdvBench и др.)
Опыт работы с vector DB, RAG-пайплайнами и их безопасностью
Знание multi-modal guardrails (изображения + текст)
Опыт production-deployment ML-систем (FastAPI, Kubernetes, мониторинг)
Английский на уровне чтения документации

Мы предлагаем

Гибридный формат работы
Годовой бонус и ежегодный пересмотр зарплаты
Статус аккредитованной ИТ-компании
Расширенный ДМС с первого дня и льготное страхование для семьи
Корпоративный университет Сбера, внутренняя образовательная платформа, участие в IT-конференциях
90 дней удаленной работы из любого региона РФ
Льготная ипотека в Сбере
Бесплатная подписка СберПрайм, которой можно поделиться с 3 близкими

Технологии и навыки

Python
ML
AI
FastAPI
Docker
Kubernetes
CI/CD
SberTech
SberTech
Москва

ГрейдMiddle
ЗанятостьПолная занятость
РегионРоссия
ФорматОфис
ИсточникСкрыто
Опубликовано5 дн назад
Все вакансии компании

AI-помощник

под эту вакансию
Войди, чтобы AI оценил твоё соответствие вакансии и написал сопроводительное письмо

Похожие вакансии

Разработчик в команду геосервисов автономного транспортаЯндексQA Lead в команду AI-агентов (Python)2ГИСTech Lead Java (GigaChat)СБЕРPenetration Tester (Middle)KPMG
Мы против мошенников на площадке: если тебя просят заплатить, продиктовать код или установить непонятное приложение, прекращай общение и сразу пиши нам (чат с основателем или форма обратной связи).