AI Infrastructure & Cloud-Native Platform Engineer (m/w/d)
Über
Verantwortung
Engineering einer skalierbaren Cloud-Native-Plattform für klassische Applikationen und AI-Services mit Kubernetes/OpenShift, Infrastructure as Code und konsequent automatisierten Betriebsmodellen
Entwicklung einer zuverlässigen AI-Runtime für LLM- und Agenten-Workloads inklusive Routing, Failover, Quotas, Caching und Mandantenfähigkeit sowie transparenter Steuerung von Nutzung und Kosten
Automatisierung des gesamten Software-Lifecycles mittels CI/CD, GitOps und Security-by-Design sowie Entwicklung technischer Tools und Integrationen für Plattform- und Deploymentprozesse
Aufbau ganzheitlicher Monitoring-, Logging- und Tracing-Lösungen sowie enge Zusammenarbeit mit Development, Security, Architektur und Operations bei anspruchsvollen Enterprise-Projekten
Qualifikationen
Mehrjährige Senior-Erfahrung im DevOps-, SRE- oder Platform-Engineering-Umfeld mit tiefgehendem Know-how in containerisierten und hochverfügbaren Produktionsplattformen
Sehr gute Kenntnisse in Kubernetes/OpenShift, Docker, Terraform, Ansible und Helm sowie Erfahrung mit Jenkins, GitLab CI oder GitHub Actions und modernen GitOps-Konzepten
Solide Software-Engineering-Kompetenz für Automatisierung und Tooling sowie Kenntnisse in Observability, APIs, API-Gateways und Technologien wie Kafka oder RabbitMQ
Erfahrung mit AI-gestützten Plattformen ist besonders willkommen; Know-how in LiteLLM, RAG, Vektordatenbanken, FinOps, Service Mesh, Policy as Code oder Supply-Chain-Security stellt ein zusätzliches Plus dar