Now hiring

Site Reliability Engineer (m/w/d) (Frankfurt, DE) @ Deloitte GmbH Wirtschaftsprüfungsgesellschaft

DEOnsiteFull-time
Apply with ResuMinder

Opens on the employer's site

About this role

Du willst im Bereich Sovereign Cloud die Verfügbarkeit, Stabilität und Sicherheit moderner Cloud-Plattformen aktiv mitgestalten? Unser Team betreibt hochverfügbare Plattformen mit höchsten Anforderungen an Sicherheit, Compliance und digitale Souveränität und sorgt so für resiliente Cloud-Services. Standorte: Frankfurt (Main) , Düsseldorf , Hamburg , Hannover , Leipzig , München und Stuttgart . Dein Impact: Als Site Reliability Engineer (m/w/d) stellst du den stabilen, sicheren und skalierbaren Betrieb Kubernetes-basierter Plattformen sicher – und schaffst die Grundlage für leistungsfähige, hochverfügbare und compliant IT-Services. Plattformbetrieb: Du betreibst und wartest Kubernetes-Plattformen, verwaltest Helm Charts und Repositories und unterstützt das Lifecycle Management von Clustern und Plattformkomponenten. Automatisierung & Deployment: Mit deinem Know-how betreust du CI/CD-Pipelines, entwickelst Infrastructure-as-Code sowie Automatisierungslösungen für Provisionierung, Health Checks, Compliance und Reporting. Monitoring & Observability: In deiner Rolle optimierst du Monitoring-Lösungen, entwickelst Alert Rules und Dashboards und sorgst für eine transparente Echtzeit- und Langzeitüberwachung. Logging & Analyse: Gemeinsam mit deinem Team betreibst und optimierst du Logging-Plattformen und stellst eine zuverlässige, sichere und skalierbare Verarbeitung sowie Analyse von Log-Daten sicher. Incident Management & Security: Durch die Analyse und Behebung komplexer Störungen, die Umsetzung von Sicherheitsrichtlinien sowie die Pflege von Runbooks und Dokumentationen gewährleistest du einen stabilen und regelkonformen Betrieb. Dein Skillset: Abschluss in Informatik, Wirtschaftsinformatik oder einem vergleichbaren Fachgebiet, alternativ eine passende Ausbildung oder vergleichbare Qualifikation Erfahrung von mindestens 4 Jahren im Site Reliability Engineering, DevOps-Umfeld oder Plattformbetrieb sowie im Betrieb von Kubernetes-basierten Plattformen Kenntnisse in Linux, Kubernetes, Helm, Git-basierten Deployment-Workflows, CI/CD-Tools sowie in der Automatisierung mit Python, Go oder Bash und Infrastructure-as-Code Know-how in Monitoring-, Observability- und Logging-Lösungen, idealerweise mit Prometheus, OpenTelemetry, Grafana sowie Elasticsearch bzw. OpenSearch; relevante Zertifizierungen sind von Vorteil Deutsch und Englisch sehr gut in Wort und Schrift, Bereitschaft zur Rufbereitschaft sowie zur Sicherheitsüberprüfung Ü2 Deine Chance: Erweiterung deines Know-hows in einem technisch anspruchsvollen Umfeld mit modernen Cloud-, Kubernetes- und Observability-Technologien Sehr gute Rahmenbedingungen mit attraktiver Vergütung Attraktives Arbeitsumfeld mit Möglichkeit für mobiles Arbeiten Bist du bereit? Mach mit uns den Unterschied! Unser Recruiting-Team freut sich auf deine Bewerbungsunterlagen (CV sowie Abitur-, Hochschul- und Arbeitszeugnisse) über unser Online-Formular. Ein Anschreiben und ein Bewerbungsfoto sind bei uns nicht erforderlich. Gleiche Chancen für alle: Wir freuen uns über Bewerbungen von Menschen, die so vielfältig sind wie wir – unabhängig von Alter, Behinderung, ethnischer Herkunft und Nationalität, Geschlecht, Religion, sexueller Orientierung oder sozialer Herkunft. Noch Fragen? Alle Infos zu unserem Bewerbungsprozess findest du in unseren Bewerbungs-FAQs .

Ready to apply?

Install the ResuMinder extension and we'll auto-fill the application in seconds — no rewriting.

See how your CV scores