Назад
2 дня назад

AI/ML Engineer (LLM)

Формат работы
onsite
Тип работы
fulltime
Грейд
senior
Страна
Kazakhstan
hhВакансия с HeadHunter. Контакт ведёт на hh.ru

Мэтч & Сопровод

Покажет вашу совместимость и напишет письмо

Описание вакансии

Текст:
/
TL;DR
AI/ML Engineer (LLM): Разработка и вывод в продакшен интеллектуальных решений и RAG-пайплайнов с акцентом на инференс на собственном GPU-кластере, агентную логику и системную оценку качества. Focus on оптимизацию моделей, маршрутизацию запросов, вызов инструментов, воспроизводимые эксперименты и интеграцию с backend и DevOps.

Локация: Астана, улица Динмухамеда Кунаева, 10; работа на месте работодателя

Компания

Транстелеком развивает направление интеллектуальных решений для продуктов группы компаний, рассчитанных на десятки тысяч пользователей.

Что делать

  • Разбирать запросы заказчиков и выбирать подходящий класс AI/ML-решений.
  • Разрабатывать и улучшать RAG-пайплайны: поиск, реранжирование, сборку контекста и цитирование.
  • Поднимать и оптимизировать инференс на собственном GPU-кластере, включая выбор моделей, квантизацию, батчинг и KV-кэш.
  • Проектировать агентную логику: маршрутизацию запросов, вызов инструментов и память диалога.
  • Измерять качество с помощью golden-датасетов, офлайн-метрик, A/B-тестов в продакшене и анализа жалоб пользователей.
  • Доводить прототипы до продакшена совместно с backend- и DevOps-командами.

Требования

  • От 3 лет опыта в ML/AI-инженерии с реальным выводом моделей в продакшен.
  • Самостоятельная постановка задач: формулирование проверяемых гипотез и оценка целесообразности реализации.
  • Python на уровне промышленной разработки.
  • Практический опыт с LLM: промптинг, RAG или дообучение, доведённые до работающего результата.
  • Понимание устройства трансформеров, включая attention, токенизацию, контекстное окно и причины галлюцинаций.
  • Опыт с фреймворками инференса, векторным поиском, Docker и Git; понимание доставки кода в продакшен.

Хорошо, если есть

  • LangGraph, LangChain или LlamaIndex.
  • Fine-tuning с LoRA, QLoRA или DPO.
  • Квантизация и профилирование GPU.
  • Whisper, STT/TTS, диаризация или мультимодальность.
  • Kubernetes, Langfuse, RAGAS, казахский язык в NLP open-source и публикации.

Культура и преимущества

  • Собственная инфраструктура и работа на выделенном железе без ограничений и квот чужого облака.
  • Молодое направление с содержательными задачами и самостоятельной выработкой подходов.
  • Возможность влиять на ключевые архитектурные решения.
  • Карьерный рост и социальный пакет по коллективному договору.
  • Отпуск 28 дней и корпоративная жизнь.

Будьте осторожны: если работодатель просит войти в их систему, используя iCloud/Google, прислать код/пароль, запустить код/ПО, не делайте этого - это мошенники. Обязательно жмите "Пожаловаться" или пишите в поддержку. Подробнее в гайде →