Вакансия из Telegram канала - Название доступно после авторизации
Пожаловаться
Зарплата и рынок
По рынку СНГ данных пока нет
На международном рынке: $154к/год ($141к - $181к)
82
Хорошая вакансия
развернуть
Технически насыщенная роль с очень четкой целью - миграция устаревшей ETL-системы на современный стек Apache. Отсутствие зарплаты и названия компании - единственный минус, но сам стек технологий - топ для любого дата-инженера.
Кликните для подробной информации
Зарплата не указанаСовременный стекПонятные задачиОпыт с Highload
Оценка от Hirify AI
Мэтч & Сопровод
Покажет вашу совместимость и напишет письмо
Создать профиль и узнать мэтч
Описание вакансии
TL;DR
Data Engineer (ETL-миграция) (Apache): Миграция ETL-системы телеком-оператора с Oracle и Informatica на Apache стек с акцентом на высокопроизводительный SQL, Airflow, NiFi и Spark. Focus on перенос бизнес-логики, разработку DAG-ов и Spark-джобов, потоковую интеграцию с Kafka, мониторинг ETL и разбор инцидентов качества данных.
🧠😘😀😘😘🥰😀🫢
Data Engineer (ETL-миграция)
Формат работы: удаленный
Проект
Участие в миграции ИС на Apache стек
Условия:
Проект: Телекоммуникации
- Занятость: полная
- Локация: РФ
- Гражданство: РФ
- Формат: Удаленно
Позиция:
Роль: Data Engineer (ETL-миграция)
Локация: РФ, удаленно
График: МСК ± 2
Гражданство: РФ
Обязательно:
- Опыт миграции ETL-систем (желательно с Oracle/Informatica на Apache стек);
- Глубокий SQL: оконные функции, сложные джойны, иерархические запросы;
- Оптимизация SQL для highload (партиционирование, индексы, explain plans);
- Oracle (PL/SQL) и PostgreSQL;
- Greenplum и/или Clickhouse;
- Проектирование архитектур на Apache Spark (PySpark), NiFi, Airflow;
- Hadoop (HDFS) и Hive;
- Мониторинг ETL: Grafana/Prometheus или Victoria Metrics;
- Опыт работы с биллинговыми системами (телеком-домен).
Желательно:
- Потоковая обработка: Kafka Streams / Spark Streaming;
- Informatica PowerCenter (понимание мигрируемой системы);
- Бинарные форматы хранения в Hadoop;
- Различия: Hive vs Impala, Greenplum vs PostgreSQL, Clickhouse vs PostgreSQL;
- Patroni для кластеризации PostgreSQL/Greenplum;
- S3-хранилища;
- КриптоПро или защищенные каналы передачи данных.
Задачи:
- Миграция ETL-системы телеком-оператора с Oracle/Informatica на Apache стек (S3, Airflow, NiFi, Kafka, Greenplum);
- Перенос бизнес-логики из Informatica в высокопроизводительный SQL-код;
- Написание и оптимизация SQL для витрин данных и ETL-процессов;
- Разработка DAG-ов в Airflow;
- Настройка пайплайнов в NiFi (источники: Oracle, PostgreSQL; приемники: S3, файловые архивы);
- Разработка Spark-джобов (PySpark) для больших объемов;
- Интеграция с Kafka для потоковой передачи;
- Настройка мониторинга (Grafana/Prometheus) и отслеживание метрик;
- Разбор инцидентов по качеству данных и ошибкам загрузки;
- Code review.
Будьте осторожны: если работодатель просит войти в их систему, используя iCloud/Google, прислать код/пароль, запустить код/ПО, не делайте этого - это мошенники. Обязательно жмите "Пожаловаться" или пишите в поддержку. Подробнее в гайде →
Текст вакансии взят без изменений
Источник - Telegram канал. Название доступно после авторизации