Summary
A technology-focused organization is seeking a senior engineering leader to coordinate the reliable operation of cloud applications. You will manage critical incidents, lead root-cause analysis, oversee releases and platform updates, strengthen security and compliance practices, and improve service quality through automation, monitoring, and operational excellence. The role requires extensive cloud operations experience, strong Linux and container expertise, and the ability to connect technical execution with stakeholder needs.
Highlights
Lead critical cloud operations, drive reliability and automation improvements, coordinate complex releases, and work across engineering, security, architecture, and customer-facing teams.
Description
Ihre Aufgaben:
Koordinieren und treiben Sie Aktivitäten im Bereich des Betriebs von Cloud-Anwendungen in enger Zusammenarbeit mit leitenden Ingenieuren und den relevanten Stakeholdern voranStellen Sie den stabilen und zuverlässigen Betrieb von Cloud-basierten Anwendungen und Diensten (AWS, Azure, Alibaba Cloud) sicher und unterstützen Sie dabei die Prozesse des Incident-, Problem- und Change-ManagementsÜbernahme der Verantwortung für kritische Vorfälle (P1/P2), Leitung der Ursachenanalyse (RCA) und Vorantreiben nachhaltiger AbhilfemaßnahmenPlanung, Koordination und Durchführung von Anwendungs- und Plattform-Updates (z.
B.
Releases, Middleware, Datenbanken, Kubernetes-basierte Bereitstellungen), einschließlich der ersten AnwendungsrolloutsDefinition, Koordination und Sicherstellung der Durchführung von Testaktivitäten im Zusammenhang mit Releases und Änderungen (Integrations-, Regressions- und Abnahmetests)Enge Zusammenarbeit mit Entwicklungs- und IT-Teams, um testbare, stabile und produktionsreife Bereitstellungen sicherzustellenUnterstützung bei der Weiterentwicklung und Umsetzung von NIS2-bezogenen Anforderungen, insbesondere in Bereichen wie Betriebssicherheit, Überwachung, Vorfallmeldung und RisikomanagementVorantreiben von Initiativen zur kontinuierlichen Verbesserung mit Fokus auf Automatisierung, Stabilität und Leistungsoptimierung von AnwendungenÜberwachen und Berichten von KPIs und SLAs zur Gewährleistung von Transparenz und ServicequalitätAbstimmung mit internen und externen Stakeholdern (DevOps, Entwicklung, Architektur, Sicherheit, Kunden) zur Sicherstellung einer effizienten Bereitstellung und des BetriebsZur kontinuierlichen Verbesserung der ITIL-/ITSM-Prozesse und der Arbeitsabläufe im Servicemanagement beitragen
Ihre Qualifikation :
Umfassende Erfahrung im Betrieb von Cloud-Anwendungen, einschließlich Plattform-Updates, Störungsmanagement, Testkoordination sowie Sicherheit und Compliance (z.
B.
NIS2)5–8+ Jahre Erfahrung im Betrieb von Cloud-Anwendungen, im Bereich DevOps oder im IT-BetriebNachgewiesene Erfahrung in der Koordination komplexer technischer Themen oder Projekte (ohne direkte Personalverantwortung)Fundierte Erfahrung im Betrieb von Cloud-basierten Anwendungen auf mindestens einer der folgenden Plattformen: AWS, Azure oder Alibaba CloudFundierte Kenntnisse von Linux-basierten Umgebungen und Container-Technologien (Docker, Kubernetes)Praktische Erfahrung mit Incident-, Problem- und Change-Management in ProduktionsumgebungenErfahrung mit Anwendungs-Updates, Release-Management und LebenszyklusprozessenVerständnis für Tests im Betriebskontext (Integrationstests, Systemvalidierung, Release-Verifizierung)Vertrautheit mit Testautomatisierung und CI/CD-PipelinesKenntnisse über Sicherheits- und Compliance-Praktiken, idealerweise im Kontext von NIS2, ISO27001 oder ähnlichen RahmenwerkenErfahrung mit Monitoring, Observability und Automatisierung (z.
B.
Python, Bash, CI/CD)Strukturierter und lösungsorientierter Arbeitsstil mit der Fähigkeit, technische und organisatorische Aspekte zu verknüpfenAusgeprägte Kommunikations- und Stakeholder-Management-Fähigkeiten