Мэтч & Сопровод
Покажет вашу совместимость и напишет письмо
Описание вакансии
Текст:
TL;DR
Senior ML Engineer (TTS): Разработка и улучшение моделей синтеза речи для GigaChat и ассистентов Салют с акцентом на качество звучания и мультимодальность. Фокус на создании архитектур для voice cloning, применении RL и оптимизации моделей для промышленного использования.
Локация: Москва (офис, гибрид или удалёнка)
Компания
SberDevices (команда SaluteSpeech) занимается созданием передовых систем синтеза и распознавания звука для экосистемы Сбера.
Что делать
- Улучшать базовое качество моделей TTS и развивать мультимодальный GigaChat.
- Формулировать гипотезы, проводить эксперименты и обгонять текущие production-метрики.
- Реализовывать проекты по voice cloning, low resource и Reinforcement Learning (RL).
- Содействовать внедрению разработанных моделей в продакшн.
- Публиковать результаты исследований на внутренних семинарах и внешних ресурсах (Habr).
Требования
- Глубокие знания Python, алгоритмов и математики.
- Специализация в области Deep Learning, особенно в работе со звуком.
- Опыт обучения и вывода ML-моделей в промышленную эксплуатацию.
- Владение C++.
- Наличие научных публикаций.
- Широкий кругозор в NLP, лингвистике и физике речи.
Культура и преимущества
- Гибкий выбор формата работы: офис, гибрид или удалёнка.
- Расширенный пакет ДМС с возможностью подключения родственников.
- Страхование жизни и специальные условия по кредитам и ипотеке.
- Современный офис на Кутузовском проспекте с парковкой, спортзалом и массажными креслами.
- Доступ к огромным массивам данных и полностью автоматизированным инструментам разметки.
Процесс найма
- Первый этап: интервью с AI-рекрутером (ГигаРекрутер) в Telegram для уточнения деталей кандидатуры.
Будьте осторожны: если работодатель просит войти в их систему, используя iCloud/Google, прислать код/пароль, запустить код/ПО, не делайте этого - это мошенники. Обязательно жмите "Пожаловаться" или пишите в поддержку. Подробнее в гайде →