Zum Inhalt springen
Weitere Berufe

Site Reliability Engineer

Site Reliability Engineers sorgen dafür, dass Software-Systeme im Dauerbetrieb stabil, schnell und belastbar laufen. Sie automatisieren den Betrieb, überwachen Systeme und rücken bei Störungen aus.

4 offene Stellen zu diesem Beruf im aktuellen Bestand.

Gehalt

Was man als Site Reliability Engineer verdient

Monats- und Jahresbrutto nach Erfahrungsstufe, bundesweit
Erfahrung Von Median Bis Jahresbrutto Verhältnis
Berufseinstieg 3.800 € 4.500 € 5.300 € 54.000 €
Mit Berufserfahrung 5.000 € 6.000 € 7.200 € 72.000 €
Mit langjähriger Erfahrung 6.500 € 7.800 € 10.000 € 93.600 €

Die Spanne ist groß, weil kaum Tarifbindung besteht: Große Technologieunternehmen und Finanzdienstleister zahlen deutlich mehr als Mittelstand oder öffentliche Auftraggeber, die sich am TVöD oder TV-L orientieren. Rufbereitschaft wird meist gesondert vergütet und kann mehrere hundert Euro im Monat ausmachen.

Die Werte sind Orientierungswerte und keine amtliche Statistik. Sie sind aus öffentlich verfügbaren Erhebungen, Tarifwerken und Stellenanzeigen abgeleitet und auf volle Euro gerundet. Im Einzelfall entscheiden Betrieb, Tarifbindung, Region, Qualifikation und Verhandlung – die Abweichung nach oben wie nach unten kann erheblich sein.

Das Jahresbrutto ist das 12-fache des Monatswertes. Urlaubs- und Weihnachtsgeld sind nicht enthalten, weil sie sich von Branche zu Branche unterscheiden.

Gehalt nach Bundesland

Das Berufsbild

Was macht ein Site Reliability Engineer?

Site Reliability Engineering ist Betrieb mit den Mitteln der Softwareentwicklung. Statt Server von Hand zu pflegen, schreiben SREs Code, der Infrastruktur bereitstellt, überwacht und wiederherstellt. Der Arbeitstag besteht aus Terraform- oder Pulumi-Definitionen, Kubernetes-Manifesten, Deployment-Pipelines, Dashboards in Grafana und Abfragen in Prometheus oder Loki. Ein großer Teil der Arbeit ist Vorbeugung: Kapazitäten planen, Alarme so einstellen, dass sie nur bei echten Problemen auslösen, Fehlerbudgets mit den Entwicklungsteams aushandeln, Lasttests fahren.

Der andere Teil ist der Ernstfall. Wenn eine Datenbank überläuft, ein Rollout eine Regression ausliefert oder ein Cloud-Anbieter eine Region verliert, koordiniert der SRE die Störungsbehebung, kommuniziert nach innen und außen und schreibt danach die Nachbetrachtung. Diese Post-mortems sind zentral für den Beruf: Sie sollen Ursachen finden, nicht Schuldige. Aus ihnen entstehen die Aufgaben, die den nächsten Ausfall verhindern.

Wie wird man Site Reliability Engineer?

Es gibt keine Ausbildung mit diesem Namen. Der übliche Weg führt über ein Studium der Informatik, Wirtschaftsinformatik oder Elektrotechnik, gefolgt von einigen Jahren als Softwareentwicklerin, Systemadministrator oder DevOps-Engineer. Auch Fachinformatiker für Systemintegration kommen häufig in den Beruf, wenn sie sich Programmierung und Cloud-Technik aneignen. Quereinstieg ist möglich, verlangt aber nachweisbare Praxis: eigene Projekte, Beiträge zu Open-Source-Werkzeugen, Zertifikate wie CKA oder die Cloud-Zertifizierungen von AWS, Azure und Google. Gefragt sind Linux, Netzwerkgrundlagen, mindestens eine Sprache wie Go oder Python, Containerorchestrierung und Erfahrung mit Observability-Werkzeugen.

Was der Beruf verlangt

Der sichtbarste Preis ist die Rufbereitschaft. In den meisten Teams gibt es einen Bereitschaftsplan, der nachts und am Wochenende greift. Das wird vergütet, kostet aber Schlaf und Planbarkeit. Wer schlecht damit umgeht, dass ein Telefon um drei Uhr klingelt und danach unter Zeitdruck eine richtige Entscheidung fällig ist, sollte sich das genau überlegen. Dazu kommt die Verantwortung: Ausfälle sind messbar, teuer und sichtbar bis in die Geschäftsführung.

Fachlich ist der Beruf breit. SREs müssen Systeme verstehen, die sie nicht selbst gebaut haben, in Sprachen, die sie nicht täglich schreiben. Das Wissen veraltet schnell, Lernen gehört zur Arbeitszeit. Kommunikation ist wichtiger, als das Berufsbild vermuten lässt: Ein großer Teil der Arbeit besteht darin, Entwicklungsteams von Standards zu überzeugen, die zunächst Aufwand bedeuten. In Organisationen, die SRE nur als neuen Namen für Systembetrieb verstehen, bleibt vom eigentlichen Ansatz wenig übrig und die Rolle wird zur Feuerwehr.

Aussichten

Die Nachfrage ist hoch und stabil, weil praktisch jedes Unternehmen mit digitalen Diensten Verfügbarkeit garantieren muss. Besonders gesucht sind Leute mit Erfahrung in Kubernetes, Cloud-Kostensteuerung und Sicherheit. Entwicklungswege führen in die Spezialisierung als Platform Engineer, in die Sicherheit, in die Architektur oder in die Leitung eines Plattformteams. Wer Bereitschaftsdienst dauerhaft nicht mehr leisten will, wechselt oft in Beratung, Vorverkauf technischer Produkte oder in eine Rolle als Solution Architect.

Aufgaben

  • Verfügbarkeit und Antwortzeiten produktiver Systeme überwachen
  • Infrastruktur als Code beschreiben und automatisiert ausrollen
  • Alarmierung, Dashboards und Logging aufbauen und pflegen
  • Störungen im Bereitschaftsdienst analysieren und beheben
  • Post-mortems schreiben und Folgemaßnahmen umsetzen
  • Deployment-Pipelines und Release-Prozesse verbessern
  • Kapazität, Skalierung und Cloud-Kosten planen
  • Entwicklungsteams zu Betriebsfähigkeit und Service-Level beraten

Voraussetzungen

  • Studium der Informatik oder vergleichbare Praxiserfahrung im IT-Betrieb
  • Sichere Linux- und Netzwerkkenntnisse
  • Programmierkenntnisse, meist Go, Python oder Bash
  • Erfahrung mit Containern, Kubernetes und mindestens einer Cloud-Plattform
  • Bereitschaft zu Rufbereitschaft außerhalb der Regelarbeitszeit
  • Ruhe und strukturiertes Vorgehen unter Zeitdruck
  • Gutes technisches Englisch

Wo man arbeitet

  • Software- und Internetunternehmen
  • IT-Abteilungen von Banken, Versicherungen und Industrie
  • Cloud- und Hosting-Anbieter
  • IT-Dienstleister und Beratungshäuser
  • Behörden und öffentliche IT-Dienstleister

Der Weg in den Beruf

Üblich ist ein Bachelor- oder Masterstudium der Informatik oder eine Ausbildung zum Fachinformatiker für Systemintegration, jeweils gefolgt von zwei bis fünf Jahren Praxis in Entwicklung oder Systembetrieb. Der Titel wird meist nach diesem Zwischenschritt vergeben, nicht direkt nach dem Abschluss. Zertifikate wie Certified Kubernetes Administrator oder Cloud-Zertifizierungen ergänzen den Weg, ersetzen aber keine Betriebserfahrung.

Offene Stellen als Site Reliability Engineer

In der Suche fortsetzen

Verwandte Berufe

Cloud Architect

Cloud Architects entwerfen die technische Struktur von IT-Systemen in der Cloud und legen fest, welche Dienste, Netzwerke und Sicherheitsmechanismen ein Unternehmen einsetzt. Sie begleiten Migrationen aus dem eigenen Rechenzentrum und geben Entwicklungsteams die Leitplanken vor.

Offene Stellen
4
Monatsbrutto
4.800 – 12.000 €

DevOps Engineer

DevOps Engineers verbinden Softwareentwicklung und IT-Betrieb: Sie automatisieren Build- und Deployment-Prozesse, betreiben Cloud-Infrastruktur und sorgen dafür, dass Anwendungen zuverlässig laufen.

Offene Stellen
25
Monatsbrutto
3.800 – 10.000 €

IT Security Engineer

IT-Security Engineers schützen Netzwerke, Server und Anwendungen eines Unternehmens vor Angriffen. Sie konfigurieren Sicherheitssysteme, prüfen Schwachstellen und reagieren auf Sicherheitsvorfälle.

Offene Stellen
0
Monatsbrutto
3.600 – 9.500 €

Platform Engineer

Platform Engineers bauen und betreiben die interne Entwicklungsplattform eines Unternehmens: Build-Pipelines, Kubernetes-Cluster, Cloud-Infrastruktur und Werkzeuge, mit denen Softwareteams ihre Anwendungen ausliefern. Der Beruf liegt zwischen Softwareentwicklung und IT-Betrieb.

Offene Stellen
5
Monatsbrutto
3.600 – 9.500 €

Systemadministrator

Systemadministratoren halten Server, Netzwerke und Arbeitsplatzrechner eines Unternehmens am Laufen. Sie richten Systeme ein, überwachen sie, beheben Störungen und kümmern sich um Sicherheit und Datensicherung.

Offene Stellen
20
Monatsbrutto
2.900 – 7.000 €

Arbeitsplatz.de verwendet nur die Cookies, die für den Betrieb der Seite nötig sind. Kein Tracking, keine Werbenetzwerke, keine Auswertung Ihres Verhaltens. Einzelheiten stehen in der Datenschutzerklärung.

Datenschutz