Назад
5 дней назад

GPU-инженер (C++/CUDA)

Формат работы
remote (только Russia)/hybrid/onsite
Тип работы
fulltime
Грейд
senior
Английский
b2
Страна
Russia
vacancy_detail.hirify_telegram_tooltipВакансия из Telegram канала -

Мэтч & Сопровод

Покажет вашу совместимость и напишет письмо

Описание вакансии

TL;DR
GPU-инженер (C++/CUDA) (GPU-ускорение): Разработка и сопровождение CUDA/HIP-ядер реляционных операторов и каркаса исполнения с акцентом на управление памятью GPU, kernel fusion и сжатие данных. Focus on профилирование производительности ускорителей NVIDIA и AMD, отладку на уровне устройства и проверку изменений, подготовленных ИИ-агентами.
#c++ #cuda #gpu #nvidia

GPU-инженер (C++/CUDA)

Scailium
РФ, Москва
Полная занятость
Удаленная,офис,гибрид

З/П: Уровень вознаграждения по итогам собеседования

Должностные обязанности:

- разрабатывать и сопровождать CUDA/HIP-ядра реляционных операторов: JOIN, сортировки, агрегации, строковые и оконные функции;

-развивать каркас исполнения — пул памяти устройства, планирование CUDA streams, kernel fusion, при котором промежуточные столбцы остаются в памяти GPU между операторами;

- работать с подсистемой сжатия: кодеки RLE, delta-RLE, dictionary, LZ4, P4D, интеграция nvCOMP/hipCOMP — распаковка лежит на критическом пути сканирования;

- профилировать и настраивать производительность под каждое поколение ускорителей NVIDIA (A100 → H100 → H200 → Blackwell) и AMD Instinct MI;

- разбирать обращения с пилотных внедрений: профилирование запросов заказчика, поиск первопричины, исправление;

- проводить code review изменений, подготовленных ИИ-агентами, и доводить их до merge в основную ветку.

Знание/опыт:

- 5+ лет разработки на современном C++ (C++17), из них 2+ года — программирование GPU в производственных системах;

- уверенное владение CUDA: собственные ядра, иерархия памяти, CUDA streams и совмещение копирования с вычислениями (copy/compute overlap), occupancy, register pressure;

- опыт работы с Thrust и CUB — кодовая база движка построена вокруг этих библиотек;

- систематическое профилирование (Nsight Systems / Nsight Compute или rocprof) и отладка на уровне устройства (compute-sanitizer, cuda-gdb);

- CMake, Linux, Docker; умение быстро осваиваться в большой существующей кодовой базе;
технический английский: код, документация и обсуждение изменений ведутся на английском

Условия труда:

Команда ведёт разработку с участием ИИ-агентов: механический объём — массовые правки по сотням файлов, генерацию тестов, прогоны автоподбора параметров (tuning sweeps) — выполняют агенты, а за инженером остаются архитектурные решения, настройка производительности и проверка каждого изменения. Непроверенный код в основную ветку не попадает. Доля чтения и оценки кода в этой работе заметно выше привычной — это осознанное устройство процесса, о котором мы подробно рассказываем на первой встрече.

Условия
- полная занятость,
- бессрочный договор;
- формат работы — удалённый, офисный или гибридный, по договорённости;
- выделенный доступ к серверам с ускорителями AMD Instinct MI300X и NVIDIA с первой недели;
- уровень вознаграждения обсуждается по итогам собеседования.

Контакты:


7 906 701 09 33

_______________
Подписаться на вакансии: @rabotaembedded
Прислать вакансию: @EmbeddedWorkBot
Наш чат: @proembedded

Будьте осторожны: если работодатель просит войти в их систему, используя iCloud/Google, прислать код/пароль, запустить код/ПО, не делайте этого - это мошенники. Обязательно жмите "Пожаловаться" или пишите в поддержку. Подробнее в гайде →

Текст вакансии взят без изменений

Источник -