Задачи:
— Повышение эффективности алгоритмов: оптимизация алгоритмов с учётом аппаратных особенностей платформ, автоматизация тестирования алгоритмов и их адаптация к платформе.
— Оптимизация инференса ML-моделей: ускорение вывода моделей машинного обучения через ONNX с применением методов квантизации моделей, анализа и оптимизации структуры вычислительных графов с учётом аппаратных возможностей бортовых ускорителей.
— Управление загрузкой GPU и инфраструктурой вычислений: разработка механизмов планирования вычислений, создание инфраструктуры для запуска нагрузок и настройка мониторинга распределения ресурсов.
Требования:
— Профессиональное программирование на CUDA и C++.
— Глубокое понимание модели исполнения GPU и иерархии памяти.
— Умение измерять и объяснять, где теряется производительность.
Будет плюсом:
— Опыт работы с TensorRT, Triton, cuDNN или собственными kernel.
— Оптимизация пайплайнов обработки облаков точек или изображений.
— Знакомство с Python и ML-фреймворками (PyTorch).
Условия:
— Бесплатное участие в профильных конференциях для сотрудников Яндекса.
— Школа подготовки спикеров для выступающих на конференциях.
— Другие бонусы, полный список которых доступен на сайте компании.
Контакты работодателя доступны по кнопке «Откликнуться» после входа.