Cloud Infrastructure SRE Engineer

Stackit Cloud Colocation — Germany · Posted ~1 day ago

Skills

Site Reliability Engineering Cloud infrastructure Infrastructure as a Service Agile working IT infrastructure

🔓 Log in to save this job, tailor your resume & track your apply process — 7 days free, no card needed.

Log in to add to target list

Summary

Join an Infrastructure-as-a-Service Site Reliability Engineering team focused on building and operating modern cloud infrastructure. You will work at the intersection of agility and security, contributing to reliable infrastructure while enjoying meaningful technical ownership and fast decision-making. The role is suited to an engineer interested in cloud platforms, infrastructure reliability, and large-scale digital services.

Highlights

Work within an Infrastructure-as-a-Service Site Reliability Engineering team building and supporting cloud infrastructure. The role combines an agile environment, meaningful technical ownership, fast decision-making, and the stability of an established technology organization.

Description

Schwarz Digits schafft das technologische Fundament für digitale Entscheidungsfreiheit in Europa. Als IT- und Digitalsparte der Schwarz Gruppe entwickeln und verantworten wir einerseits die IT-Infrastrukturen für die Handelssparten Lidl und Kaufland sowie die Schwarz Produktion und PreZero. Gleichzeitig agieren wir als unabhängiger Anbieter am externen Markt, um Unternehmen in ganz Europa bei ihrer digitalen Transformation zu unterstützen. Unsere Kernleistungen bündeln wir in den Bereichen Cloud, Cyber Security, Data & AI, Communication und Workspace. Trage auch du zur digitalen Entscheidungsfreiheit in Europa bei. Bei uns arbeitest du an der Schnittstelle zwischen Agilität und Sicherheit: Du profitierst von den schnellen Entscheidungswegen, genießt echte Gestaltungsspielräume in deinen Projekten und baust dabei auf das stabile Fundament der Schwarz Gruppe. Deine Aufgaben Du bist Teil des Infrastructure-as-a-Service Site-Relialibty-Engeering (IaaS SRE) Teams und unterstützt den Aufbau einer hoch performanten Cloud-Plattform auf Basis von OpenStack mit Fokus auf Skalierung und Erweiterung über Rechenzentrums- und Landesgrenzen hinausDu betreibst und optimierst kontinuierlich die technischen Prozessabläufe durch effiziente Automatisierung und Weiterentwicklung in den Programmiersprachen Golang und/oder PythonDu verantwortest und optimierst die Bereitstellung von Baremetal-Resourcen verschiedenster Hersteller auf Basis von OpenStack Ironic und internen und/oder OpenSource-basierten ToolsDu betreibst und verwaltest die umgebende Linux-basierten Systemlandschaften (z.B. Kubernetes, Proxmox) und gewährleistest die hohe Verfügbarkeit unserer Cloud-InfrastrukturDu erstellst und pflegst Dokumentationen und sorgst für die Implementierung und Wartung von Monitoring und Logging (z.B. Prometheus, Grafana, ELK Stack) für einen stabilen Betrieb der PlattformDu bist Teil eines motivierten Teams, das jederzeit nach Verbesserungen strebt und sich (und die Produkte) kontinuierlich weiterentwickelt Dein Profil Du bringst die Leidenschaft und Begeisterung für neue Technologien und Themen rund um Linux, Automatisierung, Virtualisierung und Netzwerk mitDu treibst aktiv die Verbesserung der Verfügbarkeit und Skalierung voran und bist bestrebst Prozessabläufe zu automatisierenDu bist in der Lage, technische Probleme zu analysieren und zu lösen und hast Erfahrung in der Durchführung von Root Cause AnalysenDu hast mehrjährige Erfahrung in der Implementierung und Verwaltung von Kubernetes-Umgebungen, einschließlich der Bereitstellung und SkalierungDu hast mehrjährige Erfahrung im Bereich der Softwareentwicklung, bis hin zu Build- und Releasemanagement, und überzeugst uns mit deiner Programmiererfahrung, insbesondere in Python und/oder Golang