Linux System Engineer (Forschungsumfeld) (m/w/d)
Über
Rolle
In dieser Rolle übernimmst du die Verantwortung für den Betrieb, die Optimierung und Weiterentwicklung wissenschaftlicher Rechensysteme. Du stellst eine stabile, performante und sichere Umgebung für anspruchsvolle wissenschaftliche Anwendungen sicher und sorgst dafür, dass Forschende effizient mit komplexen Daten und Modellen arbeiten können. Du analysierst technische Anforderungen, bewertest geeignete Technologien und implementierst Lösungen, die den hohen Ansprüchen an Rechenleistung und Verfügbarkeit gerecht werden. Zudem koordinierst du Wartung, Monitoring und Troubleshooting der Systeme und arbeitest eng mit Fachspezialist:innen zusammen, um optimale Workflows zu gestalten. Als erfahrene Fachkraft bringst du dein Know-how ein, um bestehende Strukturen kontinuierlich zu verbessern und innovative Ansätze in die wissenschaftliche IT-Landschaft einzubringen.
Verantwortung
Als Linux Engineer übernimmst du die Hauptverantwortung für die WLCG Tier-3 Cluster-Computing-Infrastruktur des PSI zur Unterstützung des CERN CMS-Experiments.
Du betreibst, wartest und optimierst Linux-basierte Forschungs- und Recheninfrastrukturen.
Du unterstützt die Schweizer CMS-Nutzergemeinschaft bei der Nutzung der Tier-3-Infrastruktur und stehst im aktiven Austausch mit den Nutzerinnen und Nutzern.
In dieser Rolle arbeitest du eng mit dem nationalen WLCG Tier-2-Zentrum am CSCS zusammen.
Du trägst zu den gemeinsamen operativen Verantwortlichkeiten in den HPC/HTC-Diensten des PSI bei und sicherst die gegenseitige Unterstützung im Team.
In dieser Rolle beteiligst du dich an Planung und Weiterentwicklung zukünftiger Tier-3- und Tier-2-Infrastrukturen und -Dienste für die HL-LHC-Ära.
Qualifikationen
Du verfügst über fundierte Kenntnisse in der Linux-Systemadministration in Produktions- oder Forschungsumgebungen.
Du hast Erfahrung mit Automatisierung und DevOps-Praktiken, etwa mit Ansible oder Puppet, Skripting in Bash und Python, Git-basierten Workflows sowie idealerweise CI/CD- und Infrastructure-as-Code-Konzepten.
Du bist geübt in Überwachung, Fehlerbehebung und Debugging komplexer System- und Softwareprobleme in produktiven Umgebungen.
Du zeichnest dich durch ausgeprägte analytische, problemlösende, kommunikative und kollaborative Fähigkeiten aus.
Du kennst dich idealerweise mit Batch-Systemen, verteilter Recheninfrastruktur, Containertechnologien oder Hochdurchsatz-Rechenumgebungen aus.
Du bringst vorzugsweise Kenntnisse der WLCG-Infrastruktur und -Dienste oder anderer wissenschaftlicher Rechenumgebungen mit.
Du sprichst fliessend Deutsch.