AI & DevOps Engineer (m/w/d)
Über
Verantwortung
Du konzipierst und entwickelst skalierbare KI-Infrastrukturservices, die für GPU-Workloads optimiert sind
In dieser Rolle implementierst und betreibst du Enterprise-KI-Plattformen wie Kubernetes oder OpenShift für Modellinferenz
Du betreust und wartest HPC-Cluster inklusive Bare-Metal- und virtueller GPU-Server
Du analysierst und behebst komplexe Infrastrukturprobleme über alle Hardware- und Softwareebenen hinweg
Du unterstützt Data-Science-Teams durch effiziente Bereitstellung und Skalierung der benötigten Infrastruktur
Qualifikationen
- Du verfügst über ein abgeschlossenes Hochschulstudium (Universität oder Fachhochschule) in Informatik.
- Du hast mindestens 5 Jahre Erfahrung in der IT-Systemadministration, davon über 3 Jahre mit Schwerpunkt auf Linux (idealerweise RHEL) sowie fundierte Skripting-Kenntnisse in Shell, Python und Ansible.
- Du kennst dich tiefgehend mit GPU-Topologien und -Architekturen (z.B. NVLink, PCIe-Switching) aus und arbeitest sicher mit Container-Orchestrierungstools wie Kubernetes, Terraform und ArgoCD; erste Praxis mit Prometheus, Grafana und DCGM Exporter ist vorhanden.
- Deine Arbeitsweise ist geprägt von einem proaktiven, verantwortungsbewussten Mindset, ausgeprägten analytischen und lösungsorientierten Fähigkeiten sowie der Fähigkeit, Aufgaben zu priorisieren und unter Druck verlässliche Ergebnisse zu liefern.
- Mit ITIL-Methodiken bist du vertraut und setzt diese im täglichen Betrieb zielgerichtet ein.
- Du kommunizierst fliessend auf Englisch; Deutschkenntnisse sind ein zusätzliches Plus.
Benefits