IT Operations Engineer

Emagine — Germany · Posted ~3 hours ago

Mid Full-time

Skills

IT operations incident management problem management change management monitoring capacity management cloud on-premises hybrid infrastructure

🔓 Log in to save this job, tailor your resume & track your apply process — 7 days free, no card needed.

Log in to add to target list

Summary ✨ AI‑Generated

Work as an IT Operations Engineer responsible for keeping critical production applications, platforms, and infrastructure stable, secure, and performant. You will handle maintenance, deployments, releases, monitoring, incident resolution, and operational improvements across cloud, on-premises, and hybrid environments.

Highlights

Focus on reliable and secure operation of mission-critical IT systems, with opportunities to improve monitoring, service standards, and operational processes across cloud, on-premises, and hybrid environments.

Description

Gesucht wird ein IT Operations Engineer (m/w/d) für die Bereiche Remedial Actions und Capacity Management. Escwerden verschiedene selbst entwickelte Anwendungen und technische Plattformen betrieben, die für den sicheren Netzbetrieb und die Abwicklung von Strommarktprozessen relevant sind. Der Schwerpunkt liegt klar auf „Run the Business“: Die produktiven IT-Systeme sollen stabil, sicher und performant laufen. Gleichzeitig sollen die Betriebsstrukturen professionalisiert und vereinheitlicht werden – insbesondere Monitoring, Betriebsprozesse, Service-Standards sowie Incident-, Problem- und Change-Management. Hauptaufgaben Sicherstellung des stabilen, sicheren und SLA-konformen Betriebs von produktiven Anwendungen, Betriebsplattformen und Infrastrukturkomponenten in Cloud-, On-Premises- und Hybrid-Umgebungen.Planung und Durchführung von Wartungsmaßnahmen, Deployments, Releases, Updates und Patches.Überwachung der Systemlandschaft sowie Analyse, Behebung und nachhaltige Vermeidung von Störungen und Betriebsrisiken.Aufbau und kontinuierliche Weiterentwicklung von Monitoring-, Logging- und Alerting-Lösungen einschließlich Definition und Auswertung relevanter Betriebs-KPIs.Transversale Unterstützung beim Aufbau eines zentralen Monitorings und Reportings zur übergreifenden Steuerung der IT-Services.Umsetzung operativer Betriebs-, Service- und Sicherheitsprozesse nach ITIL sowie Unterstützung bei regulatorischen und gesetzlichen Anforderungen.Erstellung und Pflege von Betriebsdokumentation, kontinuierliche Verbesserung von Verfügbarkeit, Stabilität und Performance.Enge Zusammenarbeit mit IT-Infrastruktur, Netzwerk, IT-Sicherheit und den Anwendungsverantwortlichen innerhalb der Elia Group.Teilnahme an der IT-Rufbereitschaft (remote) zur Sicherstellung des operativen Betriebs. Must-have Anforderungen Abgeschlossenes Studium oder Ausbildung im Bereich Informatik, Wirtschaftsinformatik oder einer anderen vergleichbaren IT-bezogenen Fachrichtung.Mehrjährige tiefgreifende Erfahrungen in Planung, Betrieb und Weiterentwicklung von Client-Server Applikationen auf Windows-Umgebungen.Kenntnisse des ITIL-basierten Servicemanagements (insbesondere im Change- und Incident-Management).Kenntnisse über relationale Datenbanksysteme, Zeitreihendaten, REST API, Messaging und Event Streaming.Vertrautheit mit Monitoring- und Logging-Tools (z.B. Splunk, PRTG, Grafana, Prometheus).Verständnis von IT-Sicherheitskonzepten und Best Practices.Sehr gute Deutsch- und Englischkenntnisse in Wort und Schrift (C1). Zusätzliche Fähigkeiten: Erfahrungen im Bereich Continuous Integration/Continuous Deployment (CI/CD).Energiewirtschaftliche Erfahrungen und/oder Knowhow im KRITIS-Umfeld. Einsatzort: Remote 80% / 20% Berlin Start: 01.01.2027