Senior AI Platform Engineer

Bwi Gmbh — Germany · Posted ~2 hours ago

Senior

Skills

Kubernetes GPU infrastructure AI/ML workloads Cluster resource optimization Security Monitoring and observability Prometheus Grafana Patch management Recovery strategies GPU AI/ML

🔓 Log in to save this job, tailor your resume & track your apply process — 7 days free, no card needed.

Log in to add to target list

Summary ✨ AI‑Generated

Join a large-scale technology organization as a Senior AI Platform Engineer, responsible for designing, operating, and optimizing GPU-enabled Kubernetes clusters that support AI and machine-learning workloads. You will drive security, observability, patching, recovery, and operational excellence while mentoring engineers in an agile environment.

Highlights

Senior platform engineering role focused on building and operating scalable GPU-enabled Kubernetes infrastructure for AI services. The position offers technical leadership, collaboration with data and AI specialists, and opportunities to mentor developers on deployment and platform operations.

Description

Sorge gemeinsam mit uns für die digitale Zukunftsfähigkeit der Bundeswehr. Deine Aufgaben: Planung, Aufbau und Betrieb von skalierbaren Kubernetes-Clustern mit GPU-Unterstützung als Grundlage einer KI-Serviceplattform Optimierung von Cluster-Ressourcen für KI/ML-Workloads (Scheduling, GPU-Management, Skalierung) Konzeption, Umsetzung und Überprüfung von Sicherheitsrichtlinien Entwicklung und Umsetzung einer Update-, Patch- und Recovery-Strategie Implementierung und Betrieb von Monitoring- und Observability-Lösungen (z. B. Prometheus, Grafana) Enge Zusammenarbeit in einem agilen, interdisziplinären Team aus Data Scientists, ML/AI Engineers und Fullstack Software Developers Unterstützung und Mentoring des Entwicklerteams bei Fragen zu Deployment, Betrieb und effizienter Nutzung von Kubernetes Dein Profil: Abgeschlossenes Studium (Master oder vergleichbar) im Bereich Informatik, Mathematik oder verwandte Fachrichtung Mehrjährige praktische Erfahrung (mind. 5 Jahre) im Betrieb von Container- und Virtualisierungsumgebungen mit Fokus auf Kubernetes (idealer Weise für On-Premises oder Hybrid-Cloud) Fundierte Kenntnisse in Netzwerk- und Sicherheitskonzepten im Kontext von Kubernetes und Erfahrung mit der Umsetzung von Sicherheitsrichtlinien Erfahrung mit der Bereitstellung und Administration von CI/CD-Pipelines (z. B. GitLab CI, Tekton, ArgoCD) Gutes Verständnis von DevOps-Prinzipien und Infrastructure-as-Code Von Vorteil, aber keine Voraussetzung: Entwicklung und Anpassung von Kubernetes-Operatoren sowie Erfahrung mit MLOps-Technologien (Kubeflow, MLflow, vLLM, NVIDIA Triton, DeepSpeed) Kenntnisse in der Administration von SQL-, NoSQL- und Vektor-Datenbanken Verhandlungssichere Deutschkenntnisse sowie sehr gute Englischkenntnisse in Wort und Schrift Wir bieten: Durch abwechslungsreiche und gesellschaftlich relevante Aufgaben gewährleisten wir den reibungslosen IT-Betrieb und die Digitalisierung der BundeswehrDas Ziel eint uns. Dabei sind für uns ein wertschätzender Umgang miteinander sowie ein großer Teamgeist elementarDie Vergütung liegt zwischen 87.700 € und 128.420 €. Die tatsächliche Höhe wird basierend auf deinem Verantwortungsbereich sowie Erfahrungen und Kompetenzen festgelegtWir bieten 30 Tage Jahresurlaub, 1 Brauchtumstag plus Optionen auf individuelle AnpassungenÜber unsere Benefit-App erhält man ein monatliches Guthaben und kann sich zusätzlich Steuervergünstigungen auf Tickets für den ÖPNV sichernWir ermöglichen Flexibilität, um Beruf und Privatleben in Einklang zu bringen, etwa durch mobiles Arbeiten oder VertrauensarbeitszeitWir unterstützen die berufliche und persönliche Weiterbildung durch individuelle Maßnahmen sowie einen kostenfreien Zugriff auf LinkedIn LearningUnser Jobradangebot ermöglicht das Leasing von bis zu 2 Fahrrädern