Summary
✨ AI‑Generated
A senior reliability engineering position responsible for improving cloud platform stability, scalability, and resilience. The role involves automation, operations, and modern infrastructure practices.
Highlights
Work on modern cloud platforms with strong focus on scalability, resilience, automation, and reliability in a technology-driven environment.
Description
Du möchtest moderne Cloud-Infrastrukturen nicht nur betreiben, sondern aktiv stabiler, skalierbarer und resilienter machen? Für ein international ausgerichtetes Technologieunternehmen im Finanzumfeld suchen wir einen Senior Site Reliability Engineer (m/w/d), der Verantwortung für die Zuverlässigkeit und Weiterentwicklung einer hochverfügbaren Plattform übernimmt.
Unser Kunde ist ein international tätiges Technologieunternehmen aus dem Finanz- und Banking-Umfeld mit Hauptsitz in Berlin und mehreren hundert Mitarbeitenden in Europa.
Das Unternehmen entwickelt eine moderne, skalierbare Technologieplattform, über die Geschäftskunden digitale Finanz- und Banking-Services anbieten können.
Dabei treffen Finanztechnologie, Cloud Engineering, Softwareentwicklung und moderne Plattformarchitekturen aufeinander.
Das technische Umfeld ist geprägt von einem hohen Automatisierungsgrad, modernen Cloud-Technologien und hohen Anforderungen an Verfügbarkeit, Sicherheit und Resilienz.
Die Position kann überwiegend remote aus Deutschland ausgeübt werden.
Regelmäßige Präsenz in Berlin ist vorgesehen.
Detaillierte Arbeitsbezeichnung und Arbeitsinhalte
Als Senior Site Reliability Engineer (m/w/d) übernimmst Du eine zentrale Rolle bei der Weiterentwicklung und Stabilisierung der technischen Plattform.
Deine Aufgaben:
Entwicklung und Weiterentwicklung von Monitoring- und Alerting-StandardsAufbau von Frameworks und Standards für SLIs, SLOs und SLAsWeiterentwicklung von Incident-Response- und Reliability-ProzessenEntwicklung von Maßnahmen zur Verbesserung von Resilienz, Stabilität und VerfügbarkeitAutomatisierung operativer Prozesse und Entwicklung entsprechender ToolsAufbau und Weiterentwicklung von Monitoring-DashboardsAnalyse von Kapazitätsanforderungen und frühzeitige Identifikation möglicher EngpässeEntwicklung von Architekturen mit automatisierten Failover-MechanismenReduzierung des Blast Radius einzelner Fehler und AusfälleDurchführung bzw.
Unterstützung von Chaos Engineering zur gezielten Prüfung der SystemresilienzZerlegung komplexer Architekturziele in konkrete, umsetzbare ArbeitspaketeBewertung und Auswahl geeigneter Third-Party-ToolsTechnische Betreuung von Tools und Plattformkomponenten als zentraler AnsprechpartnerPlanung und sichere Umsetzung größerer PlattformänderungenEnge Zusammenarbeit mit Development-, Platform- und Infrastructure-TeamsTeilnahme an einer 24/7-On-Call-Rotation
Warum diese Rolle besonders spannend ist
Hoher technischer Gestaltungsspielraum: Du entwickelst Standards und Strukturen aktiv mit, anstatt lediglich bestehende Systeme zu verwalten.Modernes Cloud-Umfeld: Du arbeitest mit modernen Technologien rund um Cloud, Plattform Engineering, Automation und Observability.Business-kritische Systeme: Deine Arbeit hat direkten Einfluss auf die Stabilität und Verfügbarkeit einer wichtigen digitalen Finanzplattform.SRE statt klassischem Betrieb: Der Fokus liegt auf Automatisierung, Resilienz, Skalierbarkeit und kontinuierlicher Verbesserung.Internationale Zusammenarbeit: Du arbeitest in einem internationalen, englischsprachigen Technologieumfeld.Entwicklungsmöglichkeiten: Deine fachliche und persönliche Weiterentwicklung wird durch ein transparentes Entwicklungsmodell und ein jährliches Weiterbildungsbudget unterstützt.Remote Work: Du kannst flexibel aus Deutschland arbeiten und regelmäßig aus dem Ausland tätig sein.
Dein Profil: Das bringst Du mit
Mindestens 6 Jahre Berufserfahrung in SRE, DevOps oder Software EngineeringStudium in Informatik, Software Engineering, Information Technology oder eine vergleichbare praktische QualifikationSehr gute Erfahrung mit Cloud- und PlattformtechnologienProgrammier- bzw.
Scripting-Erfahrung mit Python, Ruby, Java oder GoErfahrung mit Service Discovery und/oder Service MeshFundiertes Verständnis von Microservices und deren KommunikationErfahrung mit Capacity Planning und Performance-OptimierungKenntnisse im Aufbau hochverfügbarer und resilienter SystemeErfahrung mit Failover- und Disaster-Recovery-KonzeptenIdealerweise Erfahrung mit Chaos Engineering, z.
B.
Chaos Mesh oder GremlinErfahrung in der Entwicklung und Umsetzung von Monitoring- und Alerting-KonzeptenVerständnis von SLI, SLO und SLAErfahrung mit Incident Response und Reliability EngineeringBereitschaft zur Teilnahme an einer 24/7-RufbereitschaftVerständnis für die besonderen Anforderungen und Rahmenbedingungen des FinanzsektorsSehr gute Englischkenntnisse in Wort und SchriftDeutschkenntnisse sind von VorteilStrukturierte, eigenständige und Hands-on-ArbeitsweiseHohe Eigenverantwortung und ausgeprägtes OwnershipAgile Mentalität sowie Bereitschaft, bestehende Prozesse kontinuierlich zu hinterfragen und zu verbessern
Benefits
Remote Work aus Deutschland mit regelmäßiger Präsenz in Berlin
Möglichkeit, bis zu 12 Wochen pro Jahr aus dem Ausland zu arbeitenHomeoffice-Budget1.000 € Learning & Development Budget pro JahrIndividuelle Weiterentwicklung und transparentes Karriere-/Growth FrameworkWettbewerbsfähiges Gehalt plus variable VergütungMonatlicher Zuschuss für VerpflegungZuschuss zum Deutschlandticket28 Urlaubstage, mit zusätzlichem Urlaubsanspruch bei längerer Betriebszugehörigkeit ab dem 2.
JahrInternationales und modernes ArbeitsumfeldHoher technischer GestaltungsspielraumZusammenarbeit mit erfahrenen Engineering- und Platform-TeamsFokus auf kontinuierliche fachliche und persönliche Weiterentwicklung
Was kommt als nächstes:
Wenn du Lust hast, Teil eines engagierten Teams zu werden und gemeinsam spannende Projekte voranzubringen, dann freue ich mich auf deine Bewerbung! Komme bei Fragen gerne auf mich zu - egal ob per Telefon, per Mail oder bei LinkedIn:
Jil Nübel
Consultant
Robert Walters - Recruitment
Gorch-Fock-Wall 1a, 20354 Hamburg
Tel: +49 40 377 07 3981
Mobile: +49 (0)151 2107 8555
E-mail: Jil.Nuebel@RobertWalters.com
Web: www.robertwalters.de