5 Π΄Π½Π΅ΠΉ Π½Π°Π·Π°Π΄
Senior SRE Engineer (AI)
ΠΡΡΡ & Π‘ΠΎΠΏΡΠΎΠ²ΠΎΠ΄
ΠΠ»Ρ ΠΌΡΡΡΠ° Ρ ΡΡΠΎΠΉ Π²Π°ΠΊΠ°Π½ΡΠΈΠ΅ΠΉ Π½ΡΠΆΠ΅Π½ Plus
ΠΠΏΠΈΡΠ°Π½ΠΈΠ΅ Π²Π°ΠΊΠ°Π½ΡΠΈΠΈ
Π’Π΅ΠΊΡΡ:
TL;DR
Senior SRE Engineer (AI): Building and maintaining large-scale, distributed, fault-tolerant systems for the Genesis platform with an accent on reliability, scalability, and efficiency. Focus on optimizing infrastructure, automating toil, and driving technical decisions across SRE and development teams.
Location: London (Hybrid)
Company
is a technology company focused on building and scaling advanced artificial intelligence platforms.
What you will do
- Design and maintain large-scale, massively distributed, fault-tolerant systems.
- Optimize existing infrastructure and eliminate toil through automation to improve uptime.
- Drive solutions for complex reliability, scalability, and efficiency challenges across teams.
- Lead capacity planning, performance analysis, and proactive incident prevention.
- Cultivate a culture of reliability by guiding technical decisions that balance system health with product priorities.
Requirements
- Strong software engineering skills in Python, Go, or similar languages.
- Extensive experience in designing, analyzing, and troubleshooting distributed systems.
- Deep expertise with cloud computing platforms such as Kubernetes and Cloud Functions.
- Experience with Non-Abstract Large Systems Design (NALSD).
- Proven ability to lead complex, large-scale technical projects across multiple teams.
- Strong analytical skills in algorithms and complexity analysis to solve ambiguous problems.
Culture & Benefits
- Collaborative environment focused on intellectual curiosity and cross-team perspective.
- Opportunity to influence technical strategy and system architecture.
- Focus on building robust, reusable solutions for high-impact AI products.
ΠΡΠ΄ΡΡΠ΅ ΠΎΡΡΠΎΡΠΎΠΆΠ½Ρ: Π΅ΡΠ»ΠΈ ΡΠ°Π±ΠΎΡΠΎΠ΄Π°ΡΠ΅Π»Ρ ΠΏΡΠΎΡΠΈΡ Π²ΠΎΠΉΡΠΈ Π² ΠΈΡ ΡΠΈΡΡΠ΅ΠΌΡ, ΠΈΡΠΏΠΎΠ»ΡΠ·ΡΡ iCloud/Google, ΠΏΡΠΈΡΠ»Π°ΡΡ ΠΊΠΎΠ΄/ΠΏΠ°ΡΠΎΠ»Ρ, Π·Π°ΠΏΡΡΡΠΈΡΡ ΠΊΠΎΠ΄/ΠΠ, Π½Π΅ Π΄Π΅Π»Π°ΠΉΡΠ΅ ΡΡΠΎΠ³ΠΎ - ΡΡΠΎ ΠΌΠΎΡΠ΅Π½Π½ΠΈΠΊΠΈ. ΠΠ±ΡΠ·Π°ΡΠ΅Π»ΡΠ½ΠΎ ΠΆΠΌΠΈΡΠ΅ "ΠΠΎΠΆΠ°Π»ΠΎΠ²Π°ΡΡΡΡ" ΠΈΠ»ΠΈ ΠΏΠΈΡΠΈΡΠ΅ Π² ΠΏΠΎΠ΄Π΄Π΅ΡΠΆΠΊΡ. ΠΠΎΠ΄ΡΠΎΠ±Π½Π΅Π΅ Π² Π³Π°ΠΉΠ΄Π΅ β
ΠΠΎΡ ΠΎΠΆΠΈΠ΅ Π²Π°ΠΊΠ°Π½ΡΠΈΠΈ
11 Π΄Π½Π΅ΠΉ Π½Π°Π·Π°Π΄
Site Reliability Engineer (AI Platform)
9 Π΄Π½Π΅ΠΉ Π½Π°Π·Π°Π΄
Software Engineer/SRE (Linux)
10 Π΄Π½Π΅ΠΉ Π½Π°Π·Π°Π΄
Site Reliability Engineer (Azure)
70Β 000 - 85Β 000GBP
9 Π΄Π½Π΅ΠΉ Π½Π°Π·Π°Π΄
Director, Site Reliability Engineering
6 Π΄Π½Π΅ΠΉ Π½Π°Π·Π°Π΄
Site Reliability Engineer (SRE)
7 Π΄Π½Π΅ΠΉ Π½Π°Π·Π°Π΄