WorkaemКарьерная платформа
  • Вакансии
  • Компании
  • Зарплаты
  • Офферы
  • Сервисы
  • Блог
  • Работодателям
Workaem

Карьерная платформа для IT-специалистов: вакансии напрямую с карьерных страниц 300+ компаний, из телеграм-каналов, с международных площадок и от работодателей напрямую. Разбор условий, детектор мёртвых вакансий, AI-инструменты для резюме. Базовые функции бесплатны.

Подпишись, присылаем лучшие вакансии недели
Или читай канал в телеграме
Соискателям
Все вакансииЗа границейУдалёнка в долларахКомпании с РУ основателямиЗарплатыОфферыВозможностиСоветыСоздать резюмеТренировка интервью
По технологиям
Вакансии PythonВакансии JavaScriptВакансии ReactВакансии JavaВакансии GoВакансии Docker
По профессиям
РазработкаДизайнQA / ТестированиеАналитикаProduct / Project ManagerМаркетинг
Работодателям
Разместить вакансиюТарифыБаза кандидатовСвязаться с нами
Кабинет
РегистрацияВойтиЛичный кабинетМои откликиСохранённыеУведомления
Компания
О проектеПредложенияКонтактыБлогКонфиденциальностьУсловия использования
© 2026 Workaem. Все права защищены.КонфиденциальностьУсловияОферта
Made by IT, for IT 💛
Стажёр в команду NLP / RL (GigaChat)
ВердиктОписаниеИнструментыКомпанияПохожие
  1. Главная
  2. /
  3. Вакансии
  4. /
  5. Стажёр в команду NLP / RL (GigaChat)

Сбер·Москва·20 авг.

Стажёр в команду NLP / RL (GigaChat)

100 000 – 100 000 ₽
≈ 1,2 тыс.–1,2 тыс. $
🏢 ОфисJuniorПолная занятость
100 000 – 100 000 ₽≈ 1,2 тыс.–1,2 тыс. $
Навык востребован (Python). Но верх вилки на 38% ниже медианы грейда.
Нажмите на сигнал, чтобы увидеть, на чём он основан

Описание вакансии

Привет! Это GigaChat Reasoning — команда, которая даёт модели суперсилу размышлять. Мы придумываем среды, тренируем через Online RL, ускоряем обучение и доводим решения до продакшна.

Направления

Улучшение GigaChat Reasoning: полный цикл обучения от холодного старта до вывода модели в продакшн. Добавление новых доменов, создание датасетов и функций оценки ответов.

Развитие агентских навыков и tool calling с помощью Online RL: создание сред для обучения LLM, обучение и тестирование моделей.

Улучшение продукта Deep Research

На эти роли мы ищем талантливого NLP Engineer со знанием и опытом в Reinforcement Learning. Для всех этих экспериментов у нас есть кластер с большим числом A/H100-х.

Обязанности
Улучшать качество работы GigaChat Reasoning на русском и английском языках.
Ускорять пайплайн обучения: профилирование узких мест, эффективный сэмплинг.
Тестировать новые Loss-функции и подходы к обучению.
Помогать выводить в прод всё, что мы обучим.
Постоянно держаться up-to-date со свежими статьями.
Требования
Опыт в Online RL и хорошие теоретические знания.
Уверенное владение Python, PyTorch.
Знание базовых алгоритмов и математики.
Знания в DL, опыт обучения простых и больших моделей.
Опыт обучения моделей для продакшена.
Понимание текущего состояния эволюции больших LLM-ов.
Будет плюсом наличие публикаций.
Условия
Погружение в разработку самых современных NLP-систем.
Возможность совмещать учёбу и работу над реальными проектами.
По итогам стажировки — приглашение на Junior+ или Middle-позиции.
Полная удалёнка: работай из любой точки России, где есть интернет.

Технологии и навыки

Python
PyTorch
NLP
Market Research
LLM
Research
Сбер
Сбер
Москва

ГрейдJunior
ЗанятостьПолная занятость
РегионРоссия
ФорматОфис
ИсточникСкрыто
Опубликовано20 авг.
Все вакансии компании

AI-помощник

под эту вакансию
Войди, чтобы AI оценил твоё соответствие вакансии и написал сопроводительное письмо

Похожие вакансии

Разработчик в команду геосервисов автономного транспортаЯндексQA Lead в команду AI-агентов (Python)2ГИСPenetration Tester (Middle)KPMGЛидер команды R&D в MLСБЕР
Мы против мошенников на площадке: если тебя просят заплатить, продиктовать код или установить непонятное приложение, прекращай общение и сразу пиши нам (чат с основателем или форма обратной связи).