8 дней назад
Site Reliability Engineer II
95 098 - 122 550$
Мэтч & Сопровод
Для мэтча с этой вакансией нужен Plus
Описание вакансии
Текст:
TL;DR
Site Reliability Engineer II (Fintech/Enterprise Applications): Monitoring and maintaining the performance, availability, and stability of enterprise applications with an accent on infrastructure monitoring, incident management, and advanced alerting. Focus on administering Datadog, ELK, Grafana, and Prometheus, troubleshooting Linux/Unix environments, coordinating outage response, and supporting 24/7 operations.
Location: Office - Chicago, United States
Salary: $95,098.80–$122,550.00 per year
Company
provides enterprise applications that support performance, availability, and critical business operations in the fintech sector.
What you will do
- Administer and manage Datadog, ELK, Grafana, and Prometheus monitoring tools.
- Monitor applications, servers, networks, databases, storage systems, uptime, bandwidth, and performance.
- Perform scheduled job monitoring, incident management, initial alert triage, troubleshooting, and escalation.
- Coordinate outage communication among stakeholders and maintain standard escalation procedures.
- Apply ITIL principles to problem management and maintain monitoring dashboards.
- Prepare documentation, status updates, and daily and weekly operational reports.
Requirements
- 2–5 years of experience in application and infrastructure monitoring within a global enterprise environment.
- Strong experience creating and fine-tuning advanced alerts for monitored nodes.
- Solid understanding of Linux/Unix fundamentals, including memory, storage, networks, CPU, disks, filesystems, and services.
- Strong logical, analytical, documentation, and communication skills.
- Bachelor’s degree in Computer Science or a related field, or equivalent education and experience.
- Availability to work in a 24/7 shift environment.
Nice to have
- Linux/Unix scripting knowledge.
Culture & Benefits
- Full-time employment in an office-based Chicago role.
- Health, vision, and dental insurance.
- 401(k) plan and paid time off.
- Parental and medical leave.
- Short-term and long-term disability insurance benefits.
Будьте осторожны: если работодатель просит войти в их систему, используя iCloud/Google, прислать код/пароль, запустить код/ПО, не делайте этого - это мошенники. Обязательно жмите "Пожаловаться" или пишите в поддержку. Подробнее в гайде →
Похожие вакансии
9 дней назад
Site Reliability Engineer (Tech Infra)
136 800 - 259 200$
12 дней назад
Site Reliability Engineer (AWS)
120 000 - 185 000$
11 дней назад
Site Reliability Engineer - Vice President (Kubernetes)
130 000 - 160 000$
12 дней назад
Senior Engineer, Reliability (Observability)
101 558 - 169 229$
9 дней назад
Site Reliability Engineer (Web3)
12 дней назад
Senior Site Reliability Engineer (Cybersecurity)
112 700 - 177 100$