Site Reliability Engineer (SRE) (m/w/d)
Site Reliability Engineer (SRE) (m/w/d)
Site Reliability Engineer (SRE) (m/w/d)
Site Reliability Engineer (SRE) (m/w/d)
ventx GmbH
IT-Dienstleister
München
- Art der Beschäftigung: Vollzeit
- 63.500 € – 81.500 € (von XING geschätzt)
- Hybrid
Site Reliability Engineer (SRE) (m/w/d)
Über diesen Job
Site Reliability Engineer (SRE) München (m/w/d)
Deine Karriere bei ventx
Als Site Reliability Engineer bei ventx arbeiten Sie an der Schnittstelle zwischen Entwicklung und Betrieb. Sie verantworten die Zuverlässigkeit, Skalierbarkeit und Performance unserer Kundeninfrastrukturen, die auf Kubernetes und Public Cloud Plattformen basieren.
Ihre Kernaufgaben umfassen den Aufbau und die Automatisierung von Monitoring-Lösungen, die Implementierung von Infrastructure-as-Code-Ansätzen sowie die kontinuierliche Verbesserung von CI/CD-Pipelines. Sie analysieren Störungen, entwickeln Lösungen zur Vermeidung von Wiederholungen und arbeiten eng mit den Entwicklungsteams zusammen.
Wir suchen einen Kandidaten, der bereits Erfahrung im Betrieb von verteilten Systemen mitbringt und Scrum-Methoden anwenden kann. Die Position erfordert Hands-on-Mentalität sowie die Fähigkeit, komplexe technische Sachverhalte verständlich zu kommunizieren.
Deine Aufgaben
- Entwicklung und Wartung von Monitoring- und Alerting-Systemen zur Sicherstellung der Systemverfügbarkeit
- Automatisierung von Infrastrukturprozessen mittels Infrastructure as Code
- Betrieb und Optimierung von Kubernetes-Clustern in Cloud-Umgebungen
- Analyse und Behebung von Incidents einschließlich Post-Mortem-Dokumentation
- Implementierung von Backup- und Disaster-Recovery-Strategien
- Zusammenarbeit mit Entwicklungsteams zur Verbesserung der Deployments und Release-Prozesse
- Erstellung und Pflege von Runbooks sowie technischer Dokumentation
Dein Profil (Must-Haves)
- Mindestens 3 Jahre Berufserfahrung als SRE, DevOps Engineer oder in vergleichbarer Rolle
- Erfahrung mit Infrastructure as Code (Terraform, Ansible oder Pulumi)
- Fundierte Kenntnisse in Kubernetes (EKS, GKE oder AKS)
- Erfahrung mit Monitoring-Lösungen wie Prometheus, Grafana oder Datadog
- Praktische Erfahrung mit mindestens einer Public Cloud Plattform (AWS, Azure oder GCP)
- Erfahrung mit Git-basierten Workflows und CI/CD-Pipelines (GitLab CI, GitHub Actions oder Jenkins)
- Sehr gute Deutschkenntnisse in Wort und Schrift
- Gute Englischkenntnisse in Wort und Schrift
Wünschenswert (Nice-to-Haves)
- Zertifizierungen wie CKA, CKAD, AWS Solutions Architect oder Azure Administrator
- Erfahrung mit Service Mesh (Istio, Linkerd oder Consul Connect)
- Kenntnisse in Programmiersprachen wie Python, Go oder Bash-Scripting
- Erfahrung mit Container-Sicherheitstools (Trivy, Falco oder Aqua Security)
- Kenntnisse von Chaos Engineering (Gremlin, Litmus oder Chaos Monkey)
- Erfahrung mit Log-Aggregation (ELK Stack, Loki oder Splunk)
Job Details
- Position: Site Reliability Engineer (SRE) München (m/w/d)
- Standort: Munich
- Anstellungsart: Unbefristet
- Arbeitsort: Hybrid
- Remote: Ja (50%)
- Start: Ab sofort
- Veröffentlicht: 3. Sept. 2026