AI Platform Engineer (m/w/d)
Über
Verantwortung
Du entwickelst und betreibst skalierbare AI Infrastruktur Services für leistungsstarke GPU Workloads und moderne AI Plattformen
Dabei implementierst und verwaltest du Kubernetes und OpenShift Umgebungen für zuverlässige Model Inference-Prozesse
Du betreust HPC-Cluster mit Bare-Metal- und Virtual-GPU-Servern und löst komplexe Infrastrukturprobleme
Zudem unterstützt du Data-Science-Teams bei der Bereitstellung von Infrastruktur und übernimmst On Call Einsätze
Qualifikationen
Du verfügst über ein abgeschlossenes Studium (Universität/FH) in Informatik oder eine vergleichbare Ausbildung
Mehrjährige Erfahrung in der IT-Systemadministration sowie fundierte Kenntnisse in Linux (RHEL), Shell, Python und Ansible bringst du mit
Du kennst dich mit GPU-Architekturen, Kubernetes, Terraform, ArgoCD sowie Monitoring-Tools wie Prometheus und Grafana aus
Du kommunizierst Deutsch schriftlich sowie mündlich und verfügst über sehr gute Englischkenntnisse
Benefits