Назад
18 часов назад

Data Scientist в команду LLM

269 000 - 413 000
Формат работы
remote (только Russia)
Тип работы
fulltime
Страна
Russia
RUВакансия из Hirify RU, списка российских tech-компаний

Мэтч & Сопровод

Покажет вашу совместимость и напишет письмо

Описание вакансии

Текст:
/
TL;DR
Data Scientist в команду LLM (LLM/AI): Обучение и внедрение базовых языковых моделей для бизнес-сценариев Авито с акцентом на continual pretraining, дообучение, качество моделей и эффективность инференса. Focus on масштабирование пайплайнов обучения, оптимизацию высоконагруженных моделей, проектирование LLM-платформ и систем оценки качества.

Локация: удалённая работа или офисы в 4 городах России

Зарплата: 269 000–413 000 ₽/мес на руки

Компания

Avito развивает собственные базовые LLM и внедряет их в различные бизнес-сценарии, улучшая качество продуктов и эффективность применения моделей.

Что делать

  • Обучать и дообучать базовые языковые модели, адаптируя open-source-решения под русский язык и специфику домена.
  • Разрабатывать масштабируемые пайплайны для претрейна и дообучения LLM.
  • Исследовать архитектуры, методы обучения, reinforcement learning и синтетические данные.
  • Оптимизировать скорость и стоимость инференса высоконагруженных моделей в продакшене.
  • Проектировать внутренние LLM-платформы, multi-agent-системы и инфраструктуру оценки качества моделей.

Требования

  • Знание основ машинного и глубокого обучения, архитектуры Transformer и подходов к NLP.
  • Практический опыт обучения или дообучения нейросетевых моделей, работы с датасетами, метриками и валидацией.
  • Уверенное владение Python и PyTorch.
  • Знание Git, тестирования и практик Code Review.
  • Умение ставить эксперименты, сравнивать подходы, объяснять результаты и самостоятельно доводить задачи до результата.
  • Интерес к LLM и готовность быстро осваивать новые инструменты и методы.

Хорошо, если есть

  • Опыт работы с Hugging Face Transformers, PEFT/LoRA или другими инструментами дообучения LLM.
  • Опыт с современными NLP-моделями или их внедрением в продакшен.
  • Знание DeepSpeed, vLLM, SGLang, TensorRT-LLM и других инструментов распределённого обучения или оптимизации инференса.
  • Опыт использования Weights & Biases, MLflow, DVC и других MLOps-инструментов.
  • Участие в исследовательских проектах, open-source-разработке или соревнованиях по машинному обучению.

Культура и преимущества

  • Возможность влиять на продукт, которым пользуются миллионы людей.
  • Сложные технологические задачи и доступ к производительным GPU-кластерам.
  • Сильное экспертное сообщество для обсуждения идей и подходов.
  • Бюджет на обучение, курсы, конференции и профессиональную литературу.
  • ДМС со стоматологией с первого дня, а также терапевт и массажист в офисе.
  • Гибкий формат работы: удалённо или из офисов в 4 городах России.

Будьте осторожны: если работодатель просит войти в их систему, используя iCloud/Google, прислать код/пароль, запустить код/ПО, не делайте этого - это мошенники. Обязательно жмите "Пожаловаться" или пишите в поддержку. Подробнее в гайде →