Werde Teil eines Teams, das geschäftskritische Observability- und Logging-Plattformen auf Enterprise-Niveau betreibt.
Du verfügst über fundierte Erfahrung mit Elasticsearch, OpenSearch oder dem ELK Stack? Du interessierst dich für den stabilen Betrieb hochverfügbarer Plattformen, komplexes Troubleshooting und die Analyse technischer Incidents? Dann suchen wir genau dich.
Als Senior Elastic / OpenSearch Operations Engineer (m/w/d) verantwortest du den Betrieb einer geschäftskritischen Logging- und Observability-Plattform im Enterprise-Umfeld. Gemeinsam mit internationalen Teams sorgst du dafür, dass Milliarden von Log-Daten zuverlässig verarbeitet, analysiert und bereitgestellt werden.
Dabei arbeitest du mit modernen Technologien wie OpenSearch, Elasticsearch, Grafana, Prometheus, Kubernetes und Automatisierungslösungen und übernimmst eine zentrale Rolle im Plattformbetrieb.
Du verfügst über fundierte Erfahrung mit Elasticsearch, OpenSearch oder dem ELK Stack? Du interessierst dich für den stabilen Betrieb hochverfügbarer Plattformen, komplexes Troubleshooting und die Analyse technischer Incidents? Dann suchen wir genau dich.
Als Senior Elastic / OpenSearch Operations Engineer (m/w/d) verantwortest du den Betrieb einer geschäftskritischen Logging- und Observability-Plattform im Enterprise-Umfeld. Gemeinsam mit internationalen Teams sorgst du dafür, dass Milliarden von Log-Daten zuverlässig verarbeitet, analysiert und bereitgestellt werden.
Dabei arbeitest du mit modernen Technologien wie OpenSearch, Elasticsearch, Grafana, Prometheus, Kubernetes und Automatisierungslösungen und übernimmst eine zentrale Rolle im Plattformbetrieb.
Deine Aufgaben sind folgende:
- Betrieb, Überwachung und Optimierung großer Elasticsearch- und OpenSearch-Plattformen
- Analyse und Behebung von Incidents im 2nd- und 3rd-Level-Support
- Durchführung von Root Cause Analysen und nachhaltige Fehlerbehebung
- Sicherstellung von Verfügbarkeit, Performance und Stabilität geschäftskritischer Systeme
- Überwachung der Cluster-Gesundheit sowie Troubleshooting komplexer Plattformstörungen
- Optimierung von Index-, Sharding- und Storage-Konzepten
- Weiterentwicklung von Monitoring- und Observability-Lösungen
- Zusammenarbeit mit internationalen DevOps-, SRE- und Platform-Teams
- Automatisierung wiederkehrender Betriebsaufgaben
- Erstellung und Pflege von Runbooks, Betriebsdokumentationen und Best Practices
- Mitarbeit in einer 24/7-Betriebsorganisation und On-Call-Struktur


