Назад
3 дня назад

Инженер по обеспечению надежности генеративного ИИ (LLM)

300 000 - 450 000
Формат работы
onsite
Тип работы
fulltime
Страна
Russia
vacancy_detail.hirify_telegram_tooltipВакансия из Telegram канала -

Мэтч & Сопровод

Покажет вашу совместимость и напишет письмо

Описание вакансии

TL;DR
Инженер по обеспечению надежности генеративного ИИ (LLM): Эксплуатация GenAI-, ML- и Data-платформ с акцентом на LLM-инференс, API доступа к моделям и RAG. Фокус на оптимизации задержек, throughput, GPU-ресурсов и стоимости инференса, а также обеспечении отказоустойчивой маршрутизации и качества retrieval.
Инженер по обеспечению надежности генеративного ИИ в Lamoda

💰По итогам собеседования (ср. рын. зп 300 000 ₽ – 450 000 ₽)

📌Условия и бонусы:
Фултайм, офис (МСК).

📌Наши ожидания: 
– Опыт промышленной разработки, внедрения или эксплуатации GenAI-, ML- или Data-платформ.
– Практический опыт работы с LLM-инференсом: vLLM, Text Generation Inference, Triton Inference Server, llama.cpp или аналогичные решения.
– Понимание особенностей эксплуатации LLM: задержки, throughput, batch-запросы, потоковая генерация, контекстное окно, потребление памяти, GPU-ресурсы и стоимость инференса.
– Опыт проектирования или эксплуатации API для доступа к моделям, включая OpenAI-совместимые интерфейсы, авторизацию, лимиты, маршрутизацию и отказоустойчивость.
– Понимание принципов RAG: разбиение документов на фрагменты, эмбеддинги, векторный и гибридный поиск, reranking, фильтрация, версионирование индексов и оценка качества retrieval.

✍🏼

Будьте осторожны: если работодатель просит войти в их систему, используя iCloud/Google, прислать код/пароль, запустить код/ПО, не делайте этого - это мошенники. Обязательно жмите "Пожаловаться" или пишите в поддержку. Подробнее в гайде →

Текст вакансии взят без изменений

Источник -