Summary
Join a platform engineering team focused on scalable, stable, and highly automated infrastructure. You will operate and evolve Kubernetes clusters, provision Linux systems, manage containers, troubleshoot deployments and networking, and strengthen monitoring and logging. The role suits engineers who enjoy standardization, reproducibility, and continuous platform improvement.
Highlights
Work on scalable and stable platform infrastructure with a strong focus on automation, reproducible environments, and sustainable architecture. The role combines Kubernetes operations, Linux provisioning, troubleshooting, maintenance, and continuous platform improvement.
Description
Job Location (Short): Niederkassel, Germany
Workplace Type: Hybrid
Req Id: 2872
Aufgaben
Schwerpunkt: Kubernetes, Foreman, Provisioning, Automatisierung, Container, Monitoring/Logging
Intro
Du arbeitest strukturiert, automatisiert und mit klarem Blick auf Skalierbarkeit und Stabilität.
Du verstehst, wie Provisionierung, Containerisierung und Monitoring ineinandergreifen – und willst wissen, warum ein Deployment sauber läuft oder eben nicht.
Standardisierung, reproduzierbare Umgebungen und nachhaltige Plattformarchitektur sind für dich selbstverständlich.
Wenn du Plattformen nicht nur betreibst, sondern konsequent weiterentwickelst, bist du bei uns richtig.
Deine Aufgaben
Kubernetes Betrieb
Betrieb, Pflege und Weiterentwicklung unserer Kubernetes-ClusterAnalyse und Behebung von Problemen bei Pods, Deployments, Services und NetworkingDurchführung von Updates, Rollouts und Cluster-Wartung
Linux Provisionierung über Foreman
Provisionierung von Debian-Systemen mittels ForemanPflege und Weiterentwicklung von PXE-Konfigurationen, DHCP/TFTP und InstallationsvorlagenVerwaltung von Hostgruppen, Templates und Konfigurationsparametern
Templates & Deployment
Erstellung und Pflege von Provisioning-, Deployment- und KonfigurationstemplatesIntegration von Ansible/Puppet (sofern vorhanden) in Foreman-Workflows
Automatisierung
Automatisierung wiederkehrender Aufgaben mit Bash oder PythonUnterstützung beim Aufbau standardisierter Deployment-PipelinesOptimierung bestehender Prozesse (z.
B.
OS-Rollouts, Package-Updates, Application-Lifecycle)
Container & Troubleshooting
Fehlersuche bei containerisierten Anwendungen (Image, Entrypoint, Probes, Networking)Analyse von Logs, Events und Container-Laufzeitfehlern
Monitoring & Logging
Integration von Monitoring- und Logging-Systemen (z.
B.
Prometheus, Grafana, ELK/Graylog)Interpretation von Metriken und Ableitung konkreter MaßnahmenAufbau und Pflege von Alerting-Regeln für einen stabilen Betrieb
Abteilungsübergreifende Zusammenarbeit
Enge Kooperation mit Linux-, Java- und NetzwerkspezialistenUnterstützung bei infrastrukturellen Änderungen und ProjektumsetzungenDokumentation und Standardisierung technischer Betriebsprozesse
Ausbildung / Qualifikationen
Must-have
Fundierte Erfahrung im Betrieb von Kubernetes-ClusternSehr gute Kenntnisse in Foreman (PXE, DHCP/TFTP, Provisioning-Templates)Sicherer Umgang mit Linux (Debian) im ProduktivbetriebVerständnis von Helm, YAML, Konfigurationsmanagement und CI/CD-ProzessenErfahrung im Troubleshooting containerbasierter AnwendungenGute Scripting-Kenntnisse (Bash oder Python)Fähigkeit, Probleme strukturiert zu analysieren und sauber zu dokumentieren
Nice-to-have
Kenntnisse in Ansible, Puppet oder vergleichbaren ToolsErfahrung mit Monitoring-Stacks (z.
B.
Prometheus, Grafana, CheckMK, ELK)Grundverständnis von Netzwerkthemen (CNI, L3/L4, DNS, Routing)Erfahrung im Betrieb verteilter Systeme und Hochverfügbarkeitsumgebungen
Persönlich
Strukturierte, analytische Vorgehensweise („Hypothese → Messung → Ursache → Fix“)Hohes Verantwortungsbewusstsein im Betrieb produktionsrelevanter SystemeRuhiges, professionelles Arbeiten auch bei Incidents mit SLA-DruckTeamfähigkeit und Bereitschaft, Wissen zu teilen und Standards mitzugestaltenSehr gute Deutsch- und Englischkenntnisse in Wort und SchriftSorgfältige Dokumentations- und KommunikationsfähigkeitBereitschaft zur kontinuierlichen Weiterentwicklung
Über Octave
Octave bietet unternehmenskritische Software, die Organisationen dabei unterstützt, fundierte Entscheidungen in jeder Phase des Asset-Lebenszyklus zu treffen – Design, Build, Operate und Protect – überall dort, wo Leistung, Sicherheit und Zuverlässigkeit unverzichtbar sind und ein Versagen keine Option ist.
Durch die Umwandlung komplexer Betriebsdaten in verwertbare Erkenntnisse verbindet Octave Fachwissen, reale Bedingungen und unternehmensweite Einblicke, um Leistung, Resilienz und Reaktionsfähigkeit bei Vorfällen genau dort zu verbessern, wo es am wichtigsten ist.
Octave beschäftigt rund 7.200 Mitarbeitende in 45 Ländern.
Erfahren Sie mehr unter octave.com und folgen Sie uns auf LinkedIn.
Warum bei Octave arbeiten?
All in.
Always forward.
So arbeiten wir hier.
Wir schenken unseren Mitarbeitenden Vertrauen, weil wir davon überzeugt sind, dass dies der beste Weg ist, Potenziale freizusetzen, Ideen zum Leben zu erwecken und kontinuierlich voranzukommen.
Deshalb setzen wir uns für ein wirklich unterstützendes Arbeitsumfeld ein und stellen Ihnen die Ressourcen zur Verfügung, die Sie brauchen, um Ihre Ziele zu erreichen – unabhängig davon, wer Sie sind oder wo auf der Welt Sie sich befinden.
Alle sind willkommen
Bei Octave sind wir davon überzeugt, dass vielfältige und inklusive Teams entscheidend für den Erfolg unserer Mitarbeitenden und unseres Unternehmens sind.
Bei uns ist jede*r willkommen.
Als inklusiver Arbeitgeber diskriminieren wir nicht – im Gegenteil: Wir schätzen Unterschiede und setzen uns konsequent für Chancengleichheit, ein inklusives Umfeld und Fairness für alle ein.
Respekt ist der Grundpfeiler unseres Handelns.
Sprechen Sie sich aus und seien Sie ganz Sie selbst – hier werden Sie wertgeschätzt.