Site Reliability Engineer (SRE) (m/w/d)

Site Reliability Engineer (SRE) (m/w/d)

Saarbrücken Vollzeit 55000 - 70000 € / Jahr (geschätzt) Homeoffice (teilweise)
T

Auf einen Blick

  • Aufgaben: Gestalte innovative Observability-Lösungen für moderne Cloud- und Kubernetes-Plattformen.
  • Unternehmen: T-Systems International GmbH, ein führendes Unternehmen im digitalen Business.
  • Vorteile: Flexibles Arbeiten, attraktive Vergütung und umfangreiche Weiterbildungsmöglichkeiten.
  • Weitere Informationen: Moderne Technologien und ein offenes Arbeitsumfeld warten auf dich!
  • Warum dieser Job: Sei Teil eines dynamischen Teams und forme die Zukunft der IT-Sicherheit und Stabilität.
  • Qualifikationen: Erfahrung in Distributed Tracing, Programmierkenntnisse in Go, Python oder Shell.

Das prognostizierte Gehalt liegt zwischen 55000 - 70000 € pro Jahr.

Über T-Systems International GmbH
Bei T-Systems bieten wir unseren Geschäftskunden die richtigen Systemlösungen für ihr digitales Business. Mit unserem Portfolio stellen wir sicher, dass digitale Transformation Komplexität reduziert, Kosten einspart und die alltägliche Arbeit erleichtert. Unsere Schwerpunkte sind Konnektivität, Digital, Cloud & Infrastruktur sowie Sicherheit - Let’s power higher performance!

Über die Position
Als Site Reliability Engineer mit Schwerpunkt Observability tragen Sie maßgeblich dazu bei, Transparenz, Stabilität und Zuverlässigkeit unserer verteilten Cloud-, Edge- und Kubernetes-Plattformen sicherzustellen. Sie übernehmen eine zentrale Rolle bei der Konzeption, Implementierung und kontinuierlichen Weiterentwicklung moderner Observability-Lösungen und schaffen die Grundlage für einen zuverlässigen Betrieb komplexer, cloud-nativer Infrastrukturen.

Mit Ihrer Expertise in OpenTelemetry, Distributed Tracing und modernen Telemetrie-Architekturen entwickeln und betreiben Sie leistungsfähige Pipelines für Metrics, Logs und Traces. Dabei integrieren Sie den OpenTelemetry Collector, OTLP sowie SDKs und Auto-Instrumentation in bestehende Plattformen und schaffen eine durchgängige End-to-End-Observability über verteilte Anwendungen und Services hinweg.

Sie implementieren und betreiben Jaeger als zentrale Plattform für Distributed Tracing und entwickeln Korrelationsmechanismen zwischen Logs, Metrics und Traces, um Fehlerursachen schnell zu identifizieren und komplexe Abhängigkeiten innerhalb verteilter Systeme transparent darzustellen. Dabei berücksichtigen Sie moderne Sampling-Strategien, Context Propagation sowie effiziente Konzepte für Trace Storage und die performante Auswertung großer Telemetriedatenmengen.

Darüber hinaus integrieren Sie Security-, Infrastruktur- und Plattform-Events in zentrale SIEM-Lösungen und entwickeln standardisierte Telemetrie- und Instrumentierungskonzepte für Kubernetes- und Cloud-Native-Plattformen. Mit Ihren Programmierkenntnissen in Go, Python oder Shell automatisieren Sie Integrations- und Betriebsprozesse und leisten einen wesentlichen Beitrag zur Weiterentwicklung einer skalierbaren, hochverfügbaren und zukunftssicheren Observability-Plattform für moderne verteilte Infrastrukturen.

Must-Have Skills

  • Fundierte Erfahrung mit Distributed Tracing, einschließlich Span Correlation, Context Propagation und Sampling-Strategien
  • Erfahrung im Aufbau und Betrieb von Jaeger, insbesondere hinsichtlich Trace Storage, Indexierung und Query-Optimierung
  • Fundierte Kenntnisse in der Integration von SIEM-Lösungen, im Security Event Management sowie im Einsatz von CEF- und Syslog-basierten Protokollen
  • Gute Programmierkenntnisse in Go, Python oder Shell zur Umsetzung von Telemetrie-, Integrations- und Automatisierungsaufgaben
  • Erfahrung im Bereich Kubernetes Observability, Cloud-Native-Plattformen sowie moderner Telemetrie-Architekturen
  • Ausgeprägtes Verständnis für IT-Sicherheit und Security Awareness
  • Analytische und strukturierte Arbeitsweise
  • Erfahrung im Site Reliability Engineering oder Infrastruktur-Betrieb
  • Sehr gutes Deutsch in Wort und Schrift (C1-Niveau)

Nice-to-Have Skills

  • Integration, Administration und kontinuierliche Optimierung von Jaeger zur Visualisierung und Analyse verteilter Services und Anwendungen
  • Konzeption und Umsetzung von Korrelationsmechanismen zwischen Logs, Metrics und Traces zur Schaffung einer durchgängigen End-to-End-Observability
  • Integration von Security-, Infrastruktur- und Plattform-Events in zentrale SIEM- und Analyseplattformen zur Unterstützung von Monitoring- und Security-Prozessen
  • Entwicklung und Etablierung von Telemetrie-, Instrumentierungs- und Observability-Standards für Cloud-Native- und Kubernetes-Plattformen
  • Sicherstellung eines zuverlässigen und performanten Betriebs von Observability-Lösungen in Air-Gap-, Edge-, Fog- und verteilten Infrastrukturen

Was Sie erwartet

Sie erwartet eine anspruchsvolle Aufgabe im Umfeld moderner Cloud-Native-, Kubernetes-, Edge- und Observability-Technologien. In dieser Position gestalten Sie den Aufbau einer zukunftsfähigen Observability-Plattform aktiv mit und arbeiten an innovativen Lösungen für Telemetrie, Distributed Tracing und Security Monitoring in verteilten Infrastrukturen. Dabei kommen aktuelle Open-Source-Technologien wie OpenTelemetry, Jaeger und moderne Cloud-Native-Werkzeuge zum Einsatz, um Transparenz und Zuverlässigkeit komplexer Plattformen kontinuierlich zu verbessern. Sie arbeiten in einem technologisch anspruchsvollen Umfeld mit einem hohen Maß an Gestaltungsspielraum und leisten einen wesentlichen Beitrag zur Stabilität, Sicherheit und Skalierbarkeit geschäftskritischer Systeme.

Was wir bieten

  • Flexibilität und Work-Life-Balance: Profitieren Sie von flexiblen Arbeitszeiten, der Möglichkeit zum mobilen Arbeiten und einem hybriden Arbeitsmodell.
  • Attraktive Vergütung: Ein wettbewerbsfähiges Gehaltspaket, das Ihre Expertise und Leistung honoriert.
  • Entwicklungsmöglichkeiten: Zugang zu umfangreichen Weiterbildungsangeboten, Schulungen und Karriereentwicklungsprogrammen.
  • Modernes Arbeitsumfeld: Arbeiten Sie in einer modernen Ausstattung mit den neuesten Technologien und Tools.
  • Starke Unternehmenskultur: Eine offene und kollegiale Arbeitsatmosphäre, in der Teamarbeit und gegenseitige Unterstützung großgeschrieben werden.
  • Gesundheit und Wohlbefinden: Angebote zur Gesundheitsförderung und Initiativen, die Ihr Wohlbefinden unterstützen.
  • Zusatzleistungen: Diverse Benefits wie betriebliche Altersvorsorge, Mitarbeiterrabatte und Jobticket-Optionen.

Diese Position ist auch in Teilzeit verfügbar. Menschen mit Behinderungen haben bei gleicher Qualifikation Vorrang.

Site Reliability Engineer (SRE) (m/w/d) Arbeitgeber: T-Systems International

Als Arbeitgeber bieten wir Ihnen die Möglichkeit, in einem dynamischen und unterstützenden Team zu arbeiten, das innovative Cloud-Lösungen und modernste Technologien vorantreibt. Mit flexiblen Arbeitszeiten und der Option, bis zu 95 % remote zu arbeiten, fördern wir eine optimale Work-Life-Balance. Zudem investieren wir in Ihre persönliche und berufliche Entwicklung durch vielfältige Weiterbildungsmöglichkeiten und klare Karrierepfade innerhalb unseres global agierenden Unternehmens.

T

Kontaktdaten:

T-Systems International Recruiting-Team

StudySmarter Expertenrat🤫

Wir sind der Meinung, dass du so Site Reliability Engineer (SRE) (m/w/d) erhalten könntest

Netzwerken in der IT-Community

In der IT-Consulting-Welt sollten wir regelmäßig auf Veranstaltungen wie Tech-Meetups oder Konferenzen gehen. Hier können wir nicht nur unser Netzwerk erweitern, sondern auch direkt mit potenziellen Arbeitgebern ins Gespräch kommen und unser Interesse an einer Vollzeitstelle zeigen.

Online-Foren und Gruppen nutzen

Sich in Online-Foren und Communities wie Stack Overflow oder LinkedIn-Gruppen umzusehen, kann uns helfen, Insider-Tipps zu erhalten und Informationen über offene Stellen in der IT-Beratung zu sammeln. Vergiss nicht, aktiv zu werden und Fragen zu stellen oder dein Wissen zu teilen – das erhöht unsere Sichtbarkeit!

Direkt bei T-Systems International bewerben

Viele Unternehmen, wie T-Systems International, stemmen ihre Vollzeitstellen bevorzugt über ihre eigenen Karriere-Webseiten. Also, lass uns regelmäßig auf deren Seite vorbeischauen und uns direkt bewerben, statt nur die üblichen Jobportale zu nutzen.

Überzeugende Projekte zeigen

Wir sollten unser Portfolio oder relevante Projekte gut sichtbar machen, egal ob das auf Github, persönlich oder auf LinkedIn ist. Bei IT-Consulting-Stellen kommt es oft auf praktische Erfahrungen an, also lass uns zeigen, was wir können!

Wir glauben, dass du diese Fähigkeiten brauchst, um Site Reliability Engineer (SRE) (m/w/d) mit Bravour zu bestehen

Distributed Tracing
Span Correlation
Context Propagation
Sampling-Strategien
Jaeger
Trace Storage
Indexierung

Einige Tipps für deine Bewerbung 🫡

Zeige deine technischen Skills!:In der IT-Beratung zählen deine technischen Kenntnisse und Fähigkeiten. Achte darauf, relevante Programmiersprachen, Tools und Systeme in deinem Lebenslauf aufzulisten. Zeig auch, wenn du Zertifikate hast, die deine Kompetenz unterstützen – das könnte dir einen echten Vorteil verschaffen!

Verstehe die Branche!:Unterstreiche in deinem Anschreiben, dass du ein gutes Verständnis für aktuelle Trends und Herausforderungen in der IT-Branche hast. Zeig, dass du nicht nur die technischen Aspekte beherrschst, sondern auch die Bedürfnisse der Kunden erkennen und lösen kannst!

Deine Projekte zählen!:Falls du bereits an IT-Projekten gearbeitet hast, verlinke diese oder beschreibe sie in deinem Lebenslauf. Praktische Erfahrungen – sei es in Form von Praktika oder privaten Projekten – sind besonders wertvoll in der IT-Beratung. Zeige uns, was du kannst!

Individuelle Bewerbung ist der Schlüssel!:Jede Bewerbung sollte individuell auf T-Systems International und die ausgeschriebene Position Site Reliability Engineer (SRE) (m/w/d) zugeschnitten sein. Teile uns mit, warum gerade du eine gute Wahl für unser Team bist. Das zeigt dein Engagement und deine Motivation, die über eine Standardbewerbung hinausgeht.

Wie man sich auf ein Vorstellungsgespräch bei T-Systems International vorbereitet

Technische Vorbereitung ist alles!

Da du dich auf eine Vollzeitstelle in der IT-Beratung bewirbst, solltest du dir wirklich einen Überblick über die wichtigsten Tools und Technologien verschaffen, die in der Branche verwendet werden. Sei bereit, technische Fragen zu beantworten, die sich auf Software-Architektur oder Systemintegration beziehen könnten.

Praxisbeispiele parat haben

In der IT-Beratung ist es wichtig, konkrete Beispiele aus deiner bisherigen Erfahrung zu bringen. Überlege dir Projekte, bei denen du erfolgreich einen Kunden beraten hast oder Herausforderungen gelöst hast. Das zeigt, dass du nicht nur theoretisches Wissen hast, sondern auch in der Praxis erfolgreich sein kannst.

Soft Skills betonen

Ein großer Teil der IT-Beratung ist die Kommunikation mit Kunden und das Verständnis ihrer Bedürfnisse. Bereite dich darauf vor, über deine zwischenmenschlichen Fähigkeiten zu sprechen, wie du mit herausfordernden Kunden umgehst oder wie du in Teams arbeitest. Das wird den Interviewern zeigen, dass du mehr als nur technisches Wissen mitbringst!

Fragen zum Unternehmen vorbereiten

Schau dir spezifisch die Projekte von T-Systems International an und überlege dir, welche Fragen du dazu stellen möchtest. Zeig Interesse an den aktuellen Herausforderungen, vor denen das Unternehmen steht, und wie du dazu beitragen könntest. Das hebt dich von anderen Bewerbern ab und zeigt, dass du wirklich motiviert bist.