Site Reliability Engineer (m/w/d)

Deloitte · Düsseldorf, Nordrhein-Westfalen, DE · Germany

Site Reliability Engineer (m/w/d) senior · Technology / Software Development

Du willst im Bereich Sovereign Cloud die Verfügbarkeit, Stabilität und Sicherheit moderner Cloud-Plattformen aktiv mitgestalten? Unser Team betreibt hochverfügbare Plattformen mit höchsten Anforderungen an Sicherheit, Compliance und digitale Souveränität und sorgt so für resiliente Cloud-Services. Standorte: Frankfurt (Main), Düsseldorf, Hamburg, Hannover, Leipzig, München und Stuttgart. ## Dein Impact: Als Site Reliability Engineer (m/w/d) stellst du den stabilen, sicheren und skalierbaren Betrieb Kubernetes-basierter Plattformen sicher – und schaffst die Grundlage für leistungsfähige, hochverfügbare und compliant IT-Services. - Plattformbetrieb: Du betreibst und wartest Kubernetes-Plattformen, verwaltest Helm Charts und Repositories und unterstützt das Lifecycle Management von Clustern und Plattformkomponenten. - Automatisierung & Deployment: Mit deinem Know-how betreust du CI/CD-Pipelines, entwickelst Infrastructure-as-Code sowie Automatisierungslösungen für Provisionierung, Health Checks, Compliance und Reporting. - Monitoring & Observability: In deiner Rolle optimierst du Monitoring-Lösungen, entwickelst Alert Rules und Dashboards und sorgst für eine transparente Echtzeit- und Langzeitüberwachung. - Logging & Analyse: Gemeinsam mit deinem Team betreibst und optimierst du Logging-Plattformen und stellst eine zuverlässige, sichere und skalierbare Verarbeitung sowie Analyse von Log-Daten sicher. - Incident Management & Security: Durch die Analyse und Behebung komplexer Störungen, die Umsetzung von Sicherheitsrichtlinien sowie die Pflege von Runbooks und Dokumentationen gewährleistest du einen stabilen und regelkonformen Betrieb. ## Dein Skillset: - Abschluss in Informatik, Wirtschaftsinformatik oder einem vergleichbaren Fachgebiet, alternativ eine passende Ausbildung oder vergleichbare Qualifikation - Erfahrung von mindestens 4 Jahren im Site Reliability Engineering, DevOps-Umfeld oder Plattformbetrieb sowie im Betrieb von Kubernetes-basierten Plattformen - Kenntnisse in Linux, Kubernetes, Helm, Git-basierten Deployment-Workflows, CI/CD-Tools sowie in der Automatisierung mit Python, Go oder Bash und Infrastructure-as-Code - Know-how in Monitoring-, Observability- und Logging-Lösungen, idealerweise mit Prometheus, OpenTelemetry, Grafana sowie Elasticsearch bzw. OpenSearch; relevante Zertifizierungen sind von Vorteil - Deutsch und Englisch sehr gut in Wort und Schrift, Bereitschaft zur Rufbereitschaft sowie zur Sicherheitsüberprüfung Ü2 ## Deine Chance: - Erweiterung deines Know-hows in einem technisch anspruchsvollen Umfeld mit modernen Cloud-, Kubernetes- und Observability-Technologien - Sehr gute Rahmenbedingungen mit attraktiver Vergütung - Attraktives Arbeitsumfeld mit Möglichkeit für mobiles Arbeiten ## Bist du bereit? Mach mit uns den Unterschied! Unser Recruiting-Team freut sich auf deine Bewerbungsunterlagen (CV sowie Abitur-, Hochschul- und Arbeitszeugnisse) über unser Online-Formular. Ein Anschreiben und ein Bewerbungsfoto sind bei uns nicht erforderlich. Gleiche Chancen für alle: Wir freuen uns über Bewerbungen von Menschen, die so vielfältig sind wie wir – unabhängig von Alter, Behinderung, ethnischer Herkunft und Nationalität, Geschlecht, Religion, sexueller Orientierung oder sozialer Herkunft. Noch Fragen? Alle Infos zu unserem Bewerbungsprozess findest du in unseren [Bewerbungs-FAQs](https://job.deloitte.com/bewerbung/faq). Job-ID: 50496

Encuentra más ofertas como esta

Explora más ofertas activas de esta empresa o crea una cuenta en Insider Jobs para buscar, guardar y seguir oportunidades en todo el job board.