Назад
2 дня назад

AI Data Engineer (Speech)

Формат работы
hybrid/onsite
Тип работы
fulltime
Грейд
middle/senior
Страна
Russia
hhВакансия с HeadHunter. Контакт ведёт на hh.ru

Мэтч & Сопровод

Покажет вашу совместимость и напишет письмо

Описание вакансии

Текст:
/

TL;DR

AI Data Engineer (Speech): Подготовка данных для обучения и тестирования моделей GigaChat с акцентом на ML-задачи для устройств (ASR, VAD, keyword spotting). Фокус на разработке data pipeline’ов, анализе качества моделей и работе с логами для улучшения локальных ассистентов.

Компания

Крупнейшая технологическая компания, развивающая экосистему сервисов и передовые AI-решения, включая GigaChat.

Что делать

  • Подготавливать данные для обучения и тестирования ML-моделей.
  • Разрабатывать и поддерживать data pipeline’ы.
  • Анализировать качество моделей на основе данных и метрик.
  • Выявлять точки роста и проблемные сценарии в работе моделей.
  • Работать с продуктовыми и beta-логами устройств.

Требования

  • Уверенное владение Python (алгоритмы, структуры данных, async).
  • Опыт работы с данными в ML-задачах.
  • Понимание метрик качества моделей и базовой статистики.
  • Опыт в speech-задачах (ASR, VAD, diarization, keyword spotting).
  • Опыт построения data pipeline’ов и работы с разметкой/краудсорсингом.

Культура и преимущества

  • Работа в крупнейшем DS&AI сообществе (более 600 специалистов).
  • Возможность участия в НИР и написания статей для международных конференций.
  • Гибкий формат работы: офис или гибрид.
  • Расширенный ДМС, корпоративная пенсионная программа и льготная ипотека.
  • Доступ к более чем 400 образовательным программам СберУниверситета.

Процесс найма

  • Первичный этап: общение с AI-рекрутером в Telegram (около 10 минут).

Будьте осторожны: если работодатель просит войти в их систему, используя iCloud/Google, прислать код/пароль, запустить код/ПО, не делайте этого - это мошенники. Обязательно жмите "Пожаловаться" или пишите в поддержку. Подробнее в гайде →