Site Reliability Engineer - Cloud Infrastructure - STACKIT (m/w/d)
Schwarz Digits · Deutschland ·
- Category
- SRE
Site Reliability Engineer on Schwarz Digits' STACKIT cloud platform: drives a reliability-first culture by mentoring engineering teams, acting as Incident Commander, running root cause analyses, and implementing SLO measurement tooling. Core tech: SRE principles (SLOs, error budgets, toil reduction) with automation in Python or Go.
Job Description Vergewissern Sie sich, dass alle Ihre Bewerbungsunterlagen aktuell und in Ordnung sind, bevor Sie sich für diese Stelle bewerben. Du verfügst über ein ausgeprägtes „Reliability-First“-Mindset und verstehst die Balance zwischen Geschwindigkeit und Stabilität. Du hast fundierte Erfahrung im Site Reliability Engineering (SRE) und kennst die Prinzipien von SLOs, Error Budgets und Toil-Management. Du bist sicher in der Durchführung von Root Cause Analyses (RCA) und der Ableitung von …