Senior AI Platform Engineer

Bwi Gmbh — Germany · Posted ~1 hour ago

Senior

Skills

Kubernetes GPU infrastructure AI/ML workloads Cluster management Security Monitoring Observability Prometheus Grafana Deployment Recovery strategies GPU AI/ML

🔓 Log in to save this job, tailor your resume & track your apply process — 7 days free, no card needed.

Log in to add to target list

Summary ✨ AI‑Generated

A senior platform engineering role focused on building and operating scalable Kubernetes infrastructure for AI and ML workloads. You will optimize GPU resources, implement security and recovery strategies, operate monitoring and observability systems, and collaborate closely with data scientists and AI engineers. The position also includes mentoring developers on efficient deployment and Kubernetes operations.

Highlights

Work on large-scale AI infrastructure with GPU-enabled Kubernetes clusters, security, observability, and reliability challenges. The role includes collaboration with multidisciplinary AI teams and opportunities to mentor other engineers.

Description

Sorge gemeinsam mit uns für die digitale Zukunftsfähigkeit der Bundeswehr. Deine Aufgaben: Planung, Aufbau und Betrieb von skalierbaren Kubernetes-Clustern mit GPU-Unterstützung als Grundlage einer KI-Serviceplattform Optimierung von Cluster-Ressourcen für KI/ML-Workloads (Scheduling, GPU-Management, Skalierung) Konzeption, Umsetzung und Überprüfung von Sicherheitsrichtlinien Entwicklung und Umsetzung einer Update-, Patch- und Recovery-Strategie Implementierung und Betrieb von Monitoring- und Observability-Lösungen (z. B. Prometheus, Grafana) Enge Zusammenarbeit in einem agilen, interdisziplinären Team aus Data Scientists, ML/AI Engineers und Fullstack Software Developers Unterstützung und Mentoring des Entwicklerteams bei Fragen zu Deployment, Betrieb und effizienter Nutzung von Kubernetes Dein Profil: Abgeschlossenes Studium (Master oder vergleichbar) im Bereich Informatik, Mathematik oder verwandte Fachrichtung Mehrjährige praktische Erfahrung (mind. 5 Jahre) im Betrieb von Container- und Virtualisierungsumgebungen mit Fokus auf Kubernetes (idealer Weise für On-Premises oder Hybrid-Cloud) Fundierte Kenntnisse in Netzwerk- und Sicherheitskonzepten im Kontext von Kubernetes und Erfahrung mit der Umsetzung von Sicherheitsrichtlinien Erfahrung mit der Bereitstellung und Administration von CI/CD-Pipelines (z. B. GitLab CI, Tekton, ArgoCD) Gutes Verständnis von DevOps-Prinzipien und Infrastructure-as-Code Von Vorteil, aber keine Voraussetzung: Entwicklung und Anpassung von Kubernetes-Operatoren sowie Erfahrung mit MLOps-Technologien (Kubeflow, MLflow, vLLM, NVIDIA Triton, DeepSpeed) Kenntnisse in der Administration von SQL-, NoSQL- und Vektor-Datenbanken Verhandlungssichere Deutschkenntnisse sowie sehr gute Englischkenntnisse in Wort und Schrift Wir bieten: Durch abwechslungsreiche und gesellschaftlich relevante Aufgaben gewährleisten wir den reibungslosen IT-Betrieb und die Digitalisierung der BundeswehrDas Ziel eint uns. Dabei sind für uns ein wertschätzender Umgang miteinander sowie ein großer Teamgeist elementarDie Vergütung liegt zwischen 87.700 € und 128.420 €. Die tatsächliche Höhe wird basierend auf deinem Verantwortungsbereich sowie Erfahrungen und Kompetenzen festgelegtWir bieten 30 Tage Jahresurlaub, 1 Brauchtumstag plus Optionen auf individuelle AnpassungenÜber unsere Benefit-App erhält man ein monatliches Guthaben und kann sich zusätzlich Steuervergünstigungen auf Tickets für den ÖPNV sichernWir ermöglichen Flexibilität, um Beruf und Privatleben in Einklang zu bringen, etwa durch mobiles Arbeiten oder VertrauensarbeitszeitWir unterstützen die berufliche und persönliche Weiterbildung durch individuelle Maßnahmen sowie einen kostenfreien Zugriff auf LinkedIn LearningUnser Jobradangebot ermöglicht das Leasing von bis zu 2 Fahrrädern