Site Reliability Engineer (SRE) (m/w/d)
Über
Rolle
Als Site Reliability Engineer (SRE) übernimmst Du Verantwortung für eine produktive Container-Plattform auf Basis von Kubernetes und OpenShift. Der Fokus liegt auf einem stabilen, sicheren Betrieb in einem regulierten Umfeld. Gleichzeitig gestaltest Du die Plattform technisch mit und automatisierst Betriebsabläufe. Neue Cloud-Native-Themen darfst Du evaluieren und einführen. Der Austausch mit Entwicklungsteams prägt Deinen Arbeitsalltag.
Verantwortung
Du stellst den stabilen und sicheren Betrieb der containerbasierten Plattform sicher.
Du begleitest Applikationsteams beim Deployment und beim Optimieren containerisierter Anwendungen.
Hinzu kommt die Störungsanalyse bei Performance- und Stabilitätsthemen samt nachhaltiger Behebung.
Betriebsprozesse standardisierst und automatisierst Du Schritt für Schritt.
Darüber hinaus baust Du Lösungen für Monitoring, Logging und Observability mit auf.
Zudem prüfst Du neue Technologien im Container-Umfeld und achtest auf Security- und Compliance-Vorgaben.
Qualifikationen
Du hast Container-Plattformen wie Kubernetes oder OpenShift bereits betrieben oder ausgebaut.
Linux als Betriebssystem administrierst Du routiniert.
Erste Berührungspunkte mit GitOps- und Deployment-Werkzeugen wie Helm oder ArgoCD helfen Dir weiter.
Des Weiteren kennst Du Infrastructure as Code und automatisierst gerne, etwa mit Ansible.
Netzwerk- und Sicherheitskonzepte im Container-Kontext verstehst Du im Grundsatz.
Zudem löst Du Probleme methodisch, schätzt Teamarbeit über Fachbereiche hinweg und drückst Dich auf Deutsch klar aus. Regelmässige Bereitschaftsdienste sind für Dich in Ordnung.
Benefits