Назад
обновлено 6 дней назад

Senior Data Analyst (Scala API)

450 000 - 500 000₽
Формат работы
onsite
Тип работы
fulltime
Грейд
senior
Страна
Russia
RUВакансия из Hirify RU, списка российских tech-компаний

Мэтч & Сопровод

Покажет вашу совместимость и напишет письмо

Описание вакансии

Текст:
/
TL;DR
Senior Data Analyst (Scala API) (Apache Spark/AI): Разработка высоконагруженных пайплайнов обработки больших данных и архитектуры хранения для DS-моделей и AI-агентов с акцентом на Scala API DataFrame, оптимизацию Spark и подготовку production-ready фичей. Focus on анализ планов выполнения Catalyst, устранение data skew, проектирование DWH и интеграцию генеративного ИИ в аналитические процессы.

Локация: офисный формат, Москва, Кутузовский проспект, д. 32, к. 1

Зарплата: 450 000–500 000 ₽ в месяц до налогов

Компания

Сбер развивает DS-модели и AI-агентов для Департамента по работе с проблемными активами (NPL), опираясь на качественные и высокопроизводительные данные.

Что делать

  • Разрабатывать высоконагруженные пайплайны обработки больших данных на Scala API DataFrame Apache Spark без SQL.
  • Оптимизировать производительность Spark, анализировать планы выполнения через Catalyst Optimizer и устранять data skew.
  • Проектировать модели данных и архитектуру хранения с использованием Data Vault или Dimensional Modeling, участвовать в проектировании DWH.
  • Готовить структурированные фичи для DS/ML-команд и участвовать во внедрении ML-моделей.
  • Обрабатывать большие объёмы неструктурированных данных и интегрировать результаты генеративного ИИ в аналитические процессы.
  • Участвовать в код-ревью, вести разработку в Git, писать модульные тесты и переводить бизнес-задачи в технические требования.

Требования

  • От 3 лет релевантного опыта в аналитике данных или DWH с фокусом на production-ready решения.
  • Экспертное владение Scala API для DataFrame Apache Spark; разработка исключительно на Scala без SQL.
  • Глубокое понимание Catalyst, умение читать Explain-планы и проводить Performance Tuning.
  • Практический опыт внедрения ML-моделей и понимание их жизненного цикла от подготовки данных до мониторинга.
  • Опыт проектирования высоконагруженных систем, знание Data Vault или Dimensional Modeling, работа с неструктурированными данными и генеративным ИИ.
  • Высшее техническое образование, владение Git и опыт прохождения код-ревью.

Хорошо, если есть

  • Опыт использования GigaChat, Kandinsky и аналогичных решений в продуктах.
  • Навыки создания и использования AI-агентов.

Культура и преимущества

  • Ежегодный пересмотр зарплаты и годовая премия.
  • Более 400 образовательных программ в СберУниверситете.
  • Спортзал и зоны отдыха.
  • Расширенный ДМС и льготное страхование для семьи.
  • Льготный ипотечный дисконт, подписка Прайм и вознаграждение за рекомендации.
  • Срочный трудовой договор.

Будьте осторожны: если работодатель просит войти в их систему, используя iCloud/Google, прислать код/пароль, запустить код/ПО, не делайте этого - это мошенники. Обязательно жмите "Пожаловаться" или пишите в поддержку. Подробнее в гайде →