Senior Systems, Platform and Reliability Engineer

Instaffo Gmbh — Germany · Posted ~22 hours ago

Senior Full-time

Skills

Systems administration Site Reliability Engineering Platform engineering DevOps Virtualization Docker Infrastructure as Code Terraform Ansible Networking AWS Automation Monitoring Incident management On-call operations Proxmox VE Kubernetes

🔓 Log in to save this job, tailor your resume & track your apply process — 7 days free, no card needed.

Log in to add to target list

Summary ✨ AI‑Generated

Take senior-level ownership of hybrid infrastructure and critical systems. You will design, build, and operate environments spanning cloud services, virtualization, containers, networking, Infrastructure as Code, automation, monitoring, and incident response. The role suits an experienced infrastructure professional who values structured work, reliability, and strong technical ownership.

Highlights

Own the design, construction, and operation of hybrid infrastructure supporting critical systems. The position offers broad exposure to cloud, virtualization, containers, infrastructure automation, monitoring, and reliability engineering, with substantial technical responsibility.

Description

Senior Systems, Platform and Reliability Engineer (m/w/d) bei Gaia AG Anforderungen Bitte beachte, dass für diese Stelle eine Arbeitserlaubnis für Deutschland erforderlich ist. Sprache: Deutsch - Fließend (C1), Englisch - Konversationssicher (B1-B2) Mehrjährige Berufserfahrung in Systems Administration, Site Reliability Engineering, Platform Engineering oder DevOpsFundierte Praxis mit Virtualisierung, idealerweise Proxmox VE, sowie Container-Technologien (Docker, Kubernetes von Vorteil)Erfahrung mit Infrastructure as Code und Configuration-Management-Tools (z. B. Terraform, Ansible)Kenntnisse in Netzwerktechnik über mehrere Standorte/Rechenzentren hinwegErfahrung mit AWS-Services im produktiven EinsatzPraxis in Automatisierung, Monitoring und Incident-/On-Call-ProzessenSelbstständige, strukturierte Arbeitsweise und hohes Verantwortungsbewusstsein für kritische SystemeFließende Deutsch- und Englischkenntnisse Tätigkeiten Design, Aufbau und Betrieb unserer hybriden Infrastruktur (On-Premises-Server, Proxmox-VE-Cluster, VMs, Container, Networking über mehrere Rechenzentren sowie ausgewählte AWS-Services)Sicherstellung von Stabilität, Sicherheit und Skalierbarkeit einer wachsenden VM-Umgebung sowie zukünftiger Kubernetes-PlattformenUmsetzung von Infrastructure as Code und Configuration Management zur Automatisierung wiederkehrender BetriebsaufgabenPatch- und Release-Management sowie Weiterentwicklung der VirtualisierungsumgebungAnalyse und Verbesserung der Application Reliability, inkl. Monitoring, Alerting und Incident ResponseTeilnahme an Rufbereitschaft (On-Call) sowie Mitwirkung an Disaster-Recovery-PlanungEntwicklung von Standards, Guidelines und Best Practices für Infrastruktur und BetriebUnterstützung der Entwicklungsteams bei Deployment-Workflows und Normalisierung von Deployment-ProzessenEnge Zusammenarbeit mit Softwareentwicklung, Security und Produktteams Über das Unternehmen GAIA AG zählt zu den weltweit führenden Unternehmen im Bereich Digital Health. Wir arbeiten erfolgreich mit namhaften Industrieunternehmen, Krankenkassen, Ärzteorganisationen sowie führenden Universitäten in Europa, den USA und Asien zusammen und vereinen wissenschaftliche, technologische und therapeutische Kompetenz unter einem Dach. Mit Therapiesoftware wie deprexis® setzen wir den weltweiten Standard für Innovation und Evidenz. Klicke auf "Bewerben" für Details zu den Benefits, dem Team und dem Bewerbungsprozess.