← Softwareentwicklung & IT

Site Reliability Engineer Lebenslauf-Beispiel

Professionelles Site Reliability Engineer-Lebenslauf-Beispiel mit von Recruitern geprüften Abschnitten, die Sie in Minuten anpassen können.

Nur ein Beispiel

Alle persönlichen Angaben und die Laufbahn in diesem Beispiel sind fiktiv. Passen Sie den Lebenslauf mit Ihren echten Daten an, bevor Sie sich bewerben.

Lebenslauf-Vorschau

Photo

Kenntnisse

Linux
Kubernetes
Prometheus
Grafana
Terraform
Python
AWS
Incident Response
Observability
CI/CD

Zertifikate

Google Professional Cloud DevOps Engineer
Google
2023-06-01
Linux Foundation Site Reliability Engineering Certificate
Linux
2022-06-01

Sprachen

Deutsch (Muttersprache)
Englisch (verhandlungssicher, C1)

Julia Neumann

Site Reliability Engineer
8 Jahre Erfahrung im Betrieb hochverfügbarer Cloud-Services und in der Verbesserung der Betriebszuverlässigkeit durch Automatisierung.

Berufserfahrung

Senior Site Reliability Engineer
Uptime FoundryVollzeit
2020-03-01 – Present
München, Deutschland
Reliability-Engineering und Incident-Management für kritische Systeme — SLOs/Error-Budgets, Auto-Remediation-Playbooks und Incident-Command.
- Leitete Reliability-Engineering und Incident-Management für kritische Systeme - Definierte Service-Level-Objectives und Error-Budgets für über 25 Microservices und verbesserte die Priorisierung der Zuverlässigkeit in Planungszyklen. - Baute Auto-Remediation-Playbooks, die durch Prometheus-Alerts ausgelöst werden, um typische Saturation-Incidents ohne Pager-Eskalation zu lösen. - Reduzierte die Dauer von P1-Incidents durch Einführung von strukturiertem Incident-Command und Tooling zur Timeline-Erfassung.
Site Reliability Engineer
Pulse Transit CloudVollzeit
2018-02-01 – 2020-02-01
Berlin, Deutschland
Hochverfügbarkeit und Observability — Multi-Region-Failover-Drills, Tuning des Kubernetes-Autoscalings und RED/USE-Metriken.
- Sicherte Hochverfügbarkeit und Observability für kundenorientierte APIs - Implementierte Multi-Region-Failover-Drills und Chaos-Szenarien, um Dependency-Timeouts und Fallback-Logik zu validieren. - Tunte Kubernetes-HPA- und VPA-Einstellungen anhand von Workload-Profilen und reduzierte CPU-Throttling bei Lastspitzen. - Instrumentierte RED- und USE-Metriken mit Dashboard-Vorlagen, die von allen Produktteams übernommen wurden.
Junior Site Reliability Engineer
Granite SignalOpsVollzeit
2016-01-01 – 2018-01-01
Hamburg, Deutschland
Unterstützung von On-Call-Betrieb und Zuverlässigkeitsautomatisierung — synthetische Checks, Post-Incident-Verifizierung und verbesserte Log-Indizierung.
- Unterstützte den On-Call-Betrieb und Aufgaben der Zuverlässigkeitsautomatisierung - Erstellte synthetische Checks für kritische Customer-Journeys und integrierte sie in die PagerDuty-Routing-Regeln. - Schrieb Post-Incident-Follow-up-Skripte zur Verifizierung von Remediation-Tasks und zur Bereinigung veralteter Alerts. - Verbesserte die Log-Indizierungsstrategie in OpenSearch und senkte die Analysezeit bei serviceübergreifenden Incidents.

Ausbildung

Technische InformatikBachelor of Science
RWTH Aachen
2014-09-01 – 2018-06-01
Abschluss in Technischer Informatik an der RWTH Aachen mit Lehrveranstaltungen zu Linux, Kubernetes, Prometheus, Abschlussprojekten und kollaborativen Projekten, die auf berufliche Rollen vorbereiteten.

Leitfaden zur Lebenslauf-Erstellung

  • Demonstrieren Sie ausgereifte Methoden zur Reaktion auf Vorfälle und zur Lernkultur.
  • Zeigen Sie messbare Zuverlässigkeitsergebnisse im Zusammenhang mit SLOs und MTTR.
  • Fügen Sie Beispiele für Automatisierung hinzu, die repetitive betriebliche Mühen eliminiert.
  • Google Professional Cloud DevOps Engineer
  • Linux Foundation Site Reliability Engineering Certificate
  • Certified Kubernetes Administrator (CKA)