Чем предстоит заниматься
Повышение эффективности алгоритмов
Вам предстоит оптимизировать алгоритмы, учитывая аппаратные особенности платформ, автоматизировать тестирование алгоритмов и их адаптацию к платформе
Оптимизация инференса ML-моделей
Совместно с МL-командой вы будете ускорять вывод моделей машинного обучения через ONNX за счёт комплексного применения методов квантизации моделей, анализа и оптимизации структуры вычислительных графов и учётом аппаратных возможностей бортовых ускорителей
Управление загрузкой GPU и инфраструктурой вычислений
Разрабатывать механизмы планирования вычислений, создавать инфраструктуру для запуска нагрузок и настраивать мониторинг распределения ресурсов
Больше о бэкенде в Яндексе — в канале Yandex for Backend