Cloud Infrastructure SRE Engineer

Schwarz Digits — Germany · Posted ~1 day ago

Senior Full-time

Skills

Linux Kubernetes OpenStack Python Golang Cloud infrastructure Automation Infrastructure monitoring Prometheus Grafana ELK Stack ELK

🔓 Log in to save this job, tailor your resume & track your apply process — 7 days free, no card needed.

Log in to add to target list

Summary

A cloud infrastructure engineering role focused on designing, operating, and improving scalable platforms. The position involves automation, container orchestration, Linux environments, monitoring solutions, and solving complex reliability challenges.

Highlights

Opportunity to build and scale a high-performance cloud platform while working with modern infrastructure technologies, automation, and reliability engineering practices in a collaborative environment.

Description

Schwarz Digits schafft das technologische Fundament für digitale Entscheidungsfreiheit in Europa. Als IT- und Digitalsparte der Schwarz Gruppe entwickeln und verantworten wir einerseits die IT-Infrastrukturen für die Handelssparten Lidl und Kaufland sowie die Schwarz Produktion und PreZero. Gleichzeitig agieren wir als unabhängiger Anbieter am externen Markt, um Unternehmen in ganz Europa bei ihrer digitalen Transformation zu unterstützen. Unsere Kernleistungen bündeln wir in den Bereichen Cloud, Cyber Security, Data & AI, Communication und Workspace. Trage auch du zur digitalen Entscheidungsfreiheit in Europa bei. Bei uns arbeitest du an der Schnittstelle zwischen Agilität und Sicherheit: Du profitierst von den schnellen Entscheidungswegen, genießt echte Gestaltungsspielräume in deinen Projekten und baust dabei auf das stabile Fundament der Schwarz Gruppe. Deine Aufgaben Du bist Teil des Infrastructure-as-a-Service Site-Relialibty-Engeering (IaaS SRE) Teams und unterstützt den Aufbau einer hoch performanten Cloud-Plattform auf Basis von OpenStack mit Fokus auf Skalierung und Erweiterung über Rechenzentrums- und Landesgrenzen hinausDu betreibst und optimierst kontinuierlich die technischen Prozessabläufe durch effiziente Automatisierung und Weiterentwicklung in den Programmiersprachen Golang und/oder PythonDu verantwortest und optimierst die Bereitstellung von Baremetal-Resourcen verschiedenster Hersteller auf Basis von OpenStack Ironic und internen und/oder OpenSource-basierten ToolsDu betreibst und verwaltest die umgebende Linux-basierten Systemlandschaften (z.B. Kubernetes, Proxmox) und gewährleistest die hohe Verfügbarkeit unserer Cloud-InfrastrukturDu erstellst und pflegst Dokumentationen und sorgst für die Implementierung und Wartung von Monitoring und Logging (z.B. Prometheus, Grafana, ELK Stack) für einen stabilen Betrieb der PlattformDu bist Teil eines motivierten Teams, das jederzeit nach Verbesserungen strebt und sich (und die Produkte) kontinuierlich weiterentwickelt Dein Profil Du bringst die Leidenschaft und Begeisterung für neue Technologien und Themen rund um Linux, Automatisierung, Virtualisierung und Netzwerk mitDu treibst aktiv die Verbesserung der Verfügbarkeit und Skalierung voran und bist bestrebst Prozessabläufe zu automatisierenDu bist in der Lage, technische Probleme zu analysieren und zu lösen und hast Erfahrung in der Durchführung von Root Cause AnalysenDu hast mehrjährige Erfahrung in der Implementierung und Verwaltung von Kubernetes-Umgebungen, einschließlich der Bereitstellung und SkalierungDu hast mehrjährige Erfahrung im Bereich der Softwareentwicklung, bis hin zu Build- und Releasemanagement, und überzeugst uns mit deiner Programmiererfahrung, insbesondere in Python und/oder Golang