WorkaemКарьерная платформа
  • Вакансии
  • Компании
  • Зарплаты
  • Офферы
  • Сервисы
  • Блог
  • Работодателям
Workaem

Карьерная платформа для IT-специалистов: вакансии напрямую с карьерных страниц 300+ компаний, из телеграм-каналов, с международных площадок и от работодателей напрямую. Разбор условий, детектор мёртвых вакансий, AI-инструменты для резюме. Базовые функции бесплатны.

Подпишись, присылаем лучшие вакансии недели
Или читай канал в телеграме
Соискателям
Все вакансииЗа границейУдалёнка в долларахКомпании с РУ основателямиЗарплатыОфферыВозможностиСоветыСоздать резюмеТренировка интервью
По технологиям
Вакансии PythonВакансии JavaScriptВакансии ReactВакансии JavaВакансии GoВакансии Docker
По профессиям
РазработкаДизайнQA / ТестированиеАналитикаProduct / Project ManagerМаркетинг
Работодателям
Разместить вакансиюТарифыБаза кандидатовСвязаться с нами
Кабинет
РегистрацияВойтиЛичный кабинетМои откликиСохранённыеУведомления
Компания
О проектеПредложенияКонтактыБлогКонфиденциальностьУсловия использования
© 2026 Workaem. Все права защищены.КонфиденциальностьУсловияОферта
Made by IT, for IT 💛
Старший LLM-разработчик в команду претрейна Alice AI LLM
ВердиктОписаниеИнструментыКомпанияПохожие
  1. Главная
  2. /
  3. Вакансии
  4. /
  5. Старший LLM-разработчик в команду претрейна Alice AI LLM

Яндекс·21 авг.

Старший LLM-разработчик в команду претрейна Alice AI LLM

🔄 ГибридMiddleПолная занятостьКорпорация
Зарплата не указана
Вилки нет, про деньги придётся договариваться с нуля.
Нажмите на сигнал, чтобы увидеть, на чём он основан

Наша компания

Претрейн — первый и самый затратный этап обучения больших языковых моделей (LLM). Его оптимизация даже на несколько процентов может сэкономить компании десятки миллионов рублей. Наша команда отвечает за скорость и стабильность обучения моделей Alice AI LLM. Мы разрабатываем фреймворк для распределённого обучения на сотнях GPU, ставим много экспериментов, ускоряем и улучшаем базовые модели, которые выкладываются в open source и интегрируются в ключевые сервисы. Помимо нас, нашим фреймворком для обучения пользуются почти все LLM-инженеры Яндекса, а некоторые его части есть в открытом доступе. На

О роли

Приглашаем в команду старшего LLM-разработчика. Откликайтесь на вакансию, даже если вы знаете не всё из перечисленного ниже, но очень хотите научиться — и уже учитесь.

Чем предстоит заниматься

Повышение скорости и стабильности претрейна Alice AI LLM
Мы прокачиваем все составляющие гигантских LLM-обучений: эффективно реализуем разные виды распределённого обучения, значительно ускоряем обучение на тысячи GPU за счёт использования типов пониженной точности и самописных CUDA/Triton-кернелов, экспериментируем с архитектурой, оптимизаторами и др. У вас будет возможность поработать над разными задачами по всему стеку предобучения
Улучшение работы с длинным контекстом
В эпоху AI-агентов и мультимодальных моделей очень важно работать с контекстами в сотни тысяч токенов. Возможность эффективной работы с контекстом такой длины ещё со стадии претрейна — большой инженерный и исследовательский вызов. Будем вместе с ним справляться
Разработка единой кодовой базы для LLM-обучений
Мы работаем над значительным улучшением и ускорением нашей инфраструктуры обучения: дизайним и пишем с нуля модули, которые будут использованы по всему стеку обучения — от претрейна до алаймента и мультимодальных обучений. Если вам всегда хотелось написать свою DL-библиотеку — это отличная возможность
Исследования и инжиниринг в одном флаконе
Вам предстоит проводить эксперименты, изучать самые последние статьи и имплементировать даже недостающие части из них. Наша команда перенимает и улучшает наработки таких компаний, как NVIDIA и DeepSeek, и рассказывает об этом на внутренних LLM-семинарах, лекциях в ШАДе и крупных конференциях
Больше об ML в Яндексе — в канале Yandex for ML

Наши требования

Обучали трансформерные модели на PyTorch с нуля
Умеете писать классный код, знаете лучшие инженерные практики
Понимаете, как устроены современные LLM
Имеете опыт в распределённом обучении: знаете, что такое FSDP и контекстный параллелизм
Разрабатывали на CUDA/Triton и сможете написать backward для Flash Attention
Классно знаете математику и можете объяснить, что такое многообразие

Технологии и навыки

Гибридный
Я
Яндекс

ГрейдMiddle
ЗанятостьПолная занятость
РегионРоссия
ФорматГибрид
ИсточникСкрыто
Опубликовано21 авг.
Все вакансии компании

AI-помощник

под эту вакансию
Войди, чтобы AI оценил твоё соответствие вакансии и написал сопроводительное письмо

Похожие вакансии

Разработчик бэкенда в команду корпоративных продуктов Яндекс Go для бизнесаЯндексСтарший DL-разработчик в команду ризонингаЯндексСтарший ML-разработчик в команду МедтехаЯндексАрхитектор решений в Yandex CloudЯндекс
Мы против мошенников на площадке: если тебя просят заплатить, продиктовать код или установить непонятное приложение, прекращай общение и сразу пиши нам (чат с основателем или форма обратной связи).