обновлено 6 дней назад
Senior Data Analyst (Scala API)
450 000 - 500 000₽
RUВакансия из Hirify RU, списка российских tech-компаний
Мэтч & Сопровод
Покажет вашу совместимость и напишет письмо
Описание вакансии
Текст:
TL;DR
Senior Data Analyst (Scala API) (Apache Spark/AI): Разработка высоконагруженных пайплайнов обработки больших данных и архитектуры хранения для DS-моделей и AI-агентов с акцентом на Scala API DataFrame, оптимизацию Spark и подготовку production-ready фичей. Focus on анализ планов выполнения Catalyst, устранение data skew, проектирование DWH и интеграцию генеративного ИИ в аналитические процессы.
Локация: офисный формат, Москва, Кутузовский проспект, д. 32, к. 1
Зарплата: 450 000–500 000 ₽ в месяц до налогов
Компания
Сбер развивает DS-модели и AI-агентов для Департамента по работе с проблемными активами (NPL), опираясь на качественные и высокопроизводительные данные.
Что делать
- Разрабатывать высоконагруженные пайплайны обработки больших данных на Scala API DataFrame Apache Spark без SQL.
- Оптимизировать производительность Spark, анализировать планы выполнения через Catalyst Optimizer и устранять data skew.
- Проектировать модели данных и архитектуру хранения с использованием Data Vault или Dimensional Modeling, участвовать в проектировании DWH.
- Готовить структурированные фичи для DS/ML-команд и участвовать во внедрении ML-моделей.
- Обрабатывать большие объёмы неструктурированных данных и интегрировать результаты генеративного ИИ в аналитические процессы.
- Участвовать в код-ревью, вести разработку в Git, писать модульные тесты и переводить бизнес-задачи в технические требования.
Требования
- От 3 лет релевантного опыта в аналитике данных или DWH с фокусом на production-ready решения.
- Экспертное владение Scala API для DataFrame Apache Spark; разработка исключительно на Scala без SQL.
- Глубокое понимание Catalyst, умение читать Explain-планы и проводить Performance Tuning.
- Практический опыт внедрения ML-моделей и понимание их жизненного цикла от подготовки данных до мониторинга.
- Опыт проектирования высоконагруженных систем, знание Data Vault или Dimensional Modeling, работа с неструктурированными данными и генеративным ИИ.
- Высшее техническое образование, владение Git и опыт прохождения код-ревью.
Хорошо, если есть
- Опыт использования GigaChat, Kandinsky и аналогичных решений в продуктах.
- Навыки создания и использования AI-агентов.
Культура и преимущества
- Ежегодный пересмотр зарплаты и годовая премия.
- Более 400 образовательных программ в СберУниверситете.
- Спортзал и зоны отдыха.
- Расширенный ДМС и льготное страхование для семьи.
- Льготный ипотечный дисконт, подписка Прайм и вознаграждение за рекомендации.
- Срочный трудовой договор.
Будьте осторожны: если работодатель просит войти в их систему, используя iCloud/Google, прислать код/пароль, запустить код/ПО, не делайте этого - это мошенники. Обязательно жмите "Пожаловаться" или пишите в поддержку. Подробнее в гайде →
Похожие вакансии
Rubytech
6 дней назад
Data Analyst (Big Data, ETL, Python, SQL)
Сбер
8 дней назад
Data Engineer (фулл-тайм офис, со знанием англ. яз.)
220 000₽
Сбер
7 дней назад
Data Engineer ClickHouse
200 000 - 300 000₽
X5 Tech
7 дней назад
Senior Data Engineer (IBP)
2ГИС
7 дней назад
Data Engineer в команду CDP
IBS
11 дней назад
Младший разработчик (Big Data, хранилище данных)
30 000 - 40 800₽