2 дня назад
AI Data Engineer (Speech)
hhВакансия с HeadHunter. Контакт ведёт на hh.ru
Мэтч & Сопровод
Покажет вашу совместимость и напишет письмо
Описание вакансии
Текст:
TL;DR
AI Data Engineer (Speech): Подготовка данных для обучения и тестирования моделей GigaChat с акцентом на ML-задачи для устройств (ASR, VAD, keyword spotting). Фокус на разработке data pipeline’ов, анализе качества моделей и работе с логами для улучшения локальных ассистентов.
Компания
Крупнейшая технологическая компания, развивающая экосистему сервисов и передовые AI-решения, включая GigaChat.
Что делать
- Подготавливать данные для обучения и тестирования ML-моделей.
- Разрабатывать и поддерживать data pipeline’ы.
- Анализировать качество моделей на основе данных и метрик.
- Выявлять точки роста и проблемные сценарии в работе моделей.
- Работать с продуктовыми и beta-логами устройств.
Требования
- Уверенное владение Python (алгоритмы, структуры данных, async).
- Опыт работы с данными в ML-задачах.
- Понимание метрик качества моделей и базовой статистики.
- Опыт в speech-задачах (ASR, VAD, diarization, keyword spotting).
- Опыт построения data pipeline’ов и работы с разметкой/краудсорсингом.
Культура и преимущества
- Работа в крупнейшем DS&AI сообществе (более 600 специалистов).
- Возможность участия в НИР и написания статей для международных конференций.
- Гибкий формат работы: офис или гибрид.
- Расширенный ДМС, корпоративная пенсионная программа и льготная ипотека.
- Доступ к более чем 400 образовательным программам СберУниверситета.
Процесс найма
- Первичный этап: общение с AI-рекрутером в Telegram (около 10 минут).
Будьте осторожны: если работодатель просит войти в их систему, используя iCloud/Google, прислать код/пароль, запустить код/ПО, не делайте этого - это мошенники. Обязательно жмите "Пожаловаться" или пишите в поддержку. Подробнее в гайде →