WorkaemКарьерная платформа
  • Вакансии
  • Компании
  • Зарплаты
  • Что спрашивают
  • Сервисы
  • Блог
  • Работодателям
Workaem

Карьерная платформа для IT-специалистов: вакансии напрямую с карьерных страниц 300+ компаний, из телеграм-каналов, с международных площадок и от работодателей напрямую. Разбор условий, детектор мёртвых вакансий, AI-инструменты для резюме. Базовые функции бесплатны.

Подпишись, присылаем лучшие вакансии недели
Или читай канал в телеграме
Соискателям
Все вакансииЗа границейУдалёнка в долларахКомпании с РУ основателямиЗарплатыТренды рынкаОфферыВопросы с собеседованийВозможностиИИ-инструментыПроверка резюме без входаСоветыСоздать резюмеТренировка интервьюИгра «Путь джуна»
По технологиям
Вакансии PythonВакансии JavaScriptВакансии ReactВакансии JavaВакансии GoВакансии Docker
По профессиям
РазработкаДизайнQA / ТестированиеАналитикаProduct / Project ManagerМаркетинг
Работодателям
Разместить вакансиюТарифыБаза кандидатовСвязаться с нами
Кабинет
РегистрацияВойтиЛичный кабинетМои откликиСохранённыеУведомления
Компания
О проектеПредложенияКонтактыБлогКонфиденциальностьУсловия использования
© 2026 Workaem. Все права защищены.КонфиденциальностьУсловияОферта
Made by IT, for IT 💛
Middle+ AI Engineer (Native Omnimodality & VLA)
ВердиктОписаниеИнструментыКомпанияПохожие
  1. Главная
  2. /
  3. Вакансии
  4. /
  5. Middle+ AI Engineer (Native Omnimodality & VLA)

ПАО Сбербанк·Москва·6 июля

Middle+ AI Engineer (Native Omnimodality & VLA)

до 500 000 ₽
≈ до 5,8 тыс. $
🏢 ОфисMiddleПолная занятостьКорпорация
до 500 000 ₽≈ до 5,8 тыс. $
82
Сильная вакансия
Платят на 43% выше медианы грейда, навык востребован (Python).
Нажмите на сигнал, чтобы увидеть, на чём он основан

Чем предстоит заниматься

Разработка принципиально новых мультимодальных представлений и кодирования информации (vision, audio, video, text)
Создание универсальных энкодеров и shared latent spaces
Vision-Language-Action (VLA) архитектуры и стрим взаимодействия с роботами
Исследование end-to-end омнимодальных моделей и обучение на масштабных мультимодальных датасетах

Наши требования

Отличный Python 3, опыт с PyTorch, bash, git, Docker, dvc
Глубокое понимание representation learning и multimodal learning
Опыт с vision, audio и video моделями
Понимание трансформеров, contrastive learning, joint embeddings
Умение быстро разбирать и воспроизводить идеи из научных статей
Опыт с VLA / Embodied AI / Robotics
Знание self-supervised и multimodal pretraining подходов
Опыт работы с streaming video/audio
Публикации, open-source вклад или исследовательский опыт

Мы предлагаем

Комфортный современный офис рядом с м. Кутузовская
Гибрид (Москва, СПБ)
Годовая премия
Корпоративный спортзал и зоны отдыха
Расширенный ДМС + страхование для семьи
Ипотека для сотрудников выгоднее (-1/3 от текущей процентной ставки)
Бесплатная подписка СберПрайм+, скидки на продукты компаний-партнеров
Вознаграждение за рекомендацию друзей в команду Сбера

Дополнительно

Ищем Middle AI Engineer для создания нативных омнимодальных архитектур — новых способов кодирования и совместного обучения в доменах изображений, аудио, видео и т.д.

Технологии и навыки

Python
Docker
AI
Git
П
ПАО Сбербанк
Москва

ГрейдMiddle
ЗанятостьПолная занятость
РегионРоссия
ФорматОфис
ИсточникСкрыто
Опубликовано6 июля
Все вакансии компании

AI-помощник

под эту вакансию
Войди, чтобы AI оценил твоё соответствие вакансии и написал сопроводительное письмо

Похожие вакансии

Разработчик в команду геосервисов автономного транспортаЯндексPenetration Tester (Middle)KPMGAppSec Technical LeadСберSenior Dynamics 365 DeveloperНаучсофт
Мы против мошенников на площадке: если тебя просят заплатить, продиктовать код или установить непонятное приложение, прекращай общение и сразу пиши нам (чат с основателем или форма обратной связи).