Site Reliability Engineer (SRE) (m/w/d)

Site Reliability Engineer (SRE) (m/w/d)

Leipzig Vollzeit 55000 - 70000 € / Jahr (geschätzt) Homeoffice (teilweise)
T

Auf einen Blick

  • Aufgaben: Sichere die Stabilität und Performance unserer Systeme als Site Reliability Engineer.
  • Unternehmen: T-Systems, ein innovatives Unternehmen im Bereich digitale Lösungen.
  • Vorteile: Flexibles Arbeiten, wettbewerbsfähiges Gehalt und umfangreiche Weiterbildungsmöglichkeiten.
  • Weitere Informationen: Offene Unternehmenskultur mit Fokus auf Gesundheit und Wohlbefinden.
  • Warum dieser Job: Gestalte moderne Technologien und mache einen echten Unterschied in der digitalen Transformation.
  • Qualifikationen: Erfahrung in Monitoring, Cloud-Technologien und Teamarbeit.

Das prognostizierte Gehalt liegt zwischen 55000 - 70000 € pro Jahr.

Über T-Systems International Gmb H

Bei T-Systems bieten wir unseren Geschäftskunden die richtigen Systemlösungen für ihr digitales Business.

Mit unserem Portfolio stellen wir sicher, dass digitale Transformation Komplexität reduziert, Kosten einspart und die alltägliche Arbeit erleichtert.

Unsere Schwerpunkte sind Konnektivität, Digital, Cloud & Infrastruktur sowie Sicherheit - Let's power higher performance!

Über T-Systems International Gmb H

Bei T-Systems bieten wir unseren Geschäftskunden die richtigen Systemlösungen für ihr digitales Business.

Mit unserem Portfolio stellen wir sicher, dass digitale Transformation Komplexität reduziert, Kosten einspart und die alltägliche Arbeit erleichtert.

Unsere Schwerpunkte sind Konnektivität, Digital, Cloud & Infrastruktur sowie Sicherheit - Let's power higher performance!

Über die Position

Als Site Reliability Engineer stehen Sie an vorderster Front, um die Stabilität, Performance und Skalierbarkeit unserer kritischen Systeme sicherzustellen.

Sie spielen eine zentrale Rolle bei der Entwicklung, dem Aufbau und der Wartung einer hochzuverlässigen und effizienten Infrastruktur.

  • Mit Ihrer Expertise in modernen Monitoring-, Observability- und Cloud-Native-Technologien gestalten Sie den Aufbau und Betrieb eines leistungsfähigen Monitoring-Stacks auf Basis von Prometheus, Grafana, Loki und Alert Manager für verteilte Fog- und Edge-Infrastrukturen.

Dabei entwickeln Sie spezialisierte Dashboards zur Überwachung von Hardwarezuständen, Ressourcenauslastung und Netzwerkverbindungen und schaffen so die Grundlage für einen transparenten und stabilen Betrieb.

  • Sie konzipieren und implementieren Alerting-Strategien für autonome Betriebsmodelle sowie Disconnected- und Air-Gap-Szenarien und stellen sicher, dass kritische Ereignisse auch unter eingeschränkten Netzwerkbedingungen zuverlässig erkannt und verarbeitet werden.

Darüber hinaus verantworten Sie die Umsetzung von lokalen Retention-Konzepten, Log-Rotation-Mechanismen und effizienten Datenmanagement-Strategien für ressourcenbeschränkte Umgebungen.

  • Ein weiterer Schwerpunkt Ihrer Tätigkeit liegt in der kontinuierlichen Performance-Optimierung des Monitoring-Stacks unter Berücksichtigung begrenzter CPU-, Speicher- und Storage-Ressourcen auf Fog-Nodes.

Sie integrieren Kubernetes-Monitoring-Lösungen, analysieren Betriebs- und Performancedaten und identifizieren proaktiv Optimierungspotenziale zur Steigerung von Stabilität, Verfügbarkeit und Effizienz der Plattform.

  • Durch den Einsatz von Infrastructure-as-Code-Ansätzen und YAML-basierten Konfigurationen automatisieren Sie die Bereitstellung und Verwaltung der Monitoring-Komponenten und leisten einen wesentlichen Beitrag zur Weiterentwicklung einer robusten, skalierbaren und hochverfügbaren Observability-Plattform für moderne Edge- und Fog-Computing-Umgebungen.
  • Must-Have Skills
  • Monitoring & Observability
  • Fundierte Erfahrung mit

Prometheus , insbesondere

  • Prom QL
  • Federation
  • Remote Write
  • Local Retention Management
  • Dashboarding & Visualisierung
  • Sehr gute Kenntnisse in

Grafana , insbesondere

  • Dashboard-Entwicklung
  • Alerting
  • Provisioning-as-Code
  • Log Management
  • Erfahrung mit

Loki , insbesondere

  • Log QL
  • Retention Management
  • Compaction
  • Alerting & Incident Management
  • Fundierte Kenntnisse in

Alert Manager , insbesondere

  • Standalone Routing
  • Alert Inhibition
  • Eskalations- und Benachrichtigungskonzepte
  • Kubernetes & Cloud Native
  • Erfahrung im Monitoring und Betrieb von Kubernetes-Umgebungen
  • Verständnis von Container-Plattformen und Cloud-Native-Architekturen
  • Edge & Fog Computing
  • Erfahrung mit ressourcenbeschränkten Umgebungen
  • Optimierung von CPU-, Memory- und Storage-Nutzung
  • Verständnis von Offline-, Air-Gap- und Disconnected-Betriebsszenarien
  • Weitere Anforderungen
  • Sehr gute Kenntnisse in YAML
  • Ausgeprägtes Verständnis für IT-Sicherheit und Security Awareness
  • Analytische und strukturierte Arbeitsweise
  • Erfahrung im Site Reliability Engineering oder Infrastruktur-Betrieb
  • Sehr gutes Deutsch in Wort und Schrift (C1-Niveau)
  • Nice-to-Have Skills
  • Infrastructure as Code (z. B. Terraform, Ansible)
  • Git Ops-Ansätze
  • Linux-Systemadministration
  • Open Telemetry und moderne Observability-Konzepte
  • Erfahrung in kritischen oder hochverfügbaren Infrastrukturen
  • Was Sie erwartet

Sie erwartet eine spannende Aufgabe im Umfeld moderner Edge-, Fog- und Cloud-Native-Technologien.

Dabei übernehmen Sie Verantwortung für die Stabilität, Verfügbarkeit und Beobachtbarkeit verteilter Infrastrukturen und gestalten den Aufbau leistungsfähiger Monitoring- und Observability-Lösungen aktiv mit.

In einem technologisch anspruchsvollen Umfeld arbeiten Sie mit aktuellen Kubernetes-, Monitoring- und Logging-Technologien und tragen dazu bei, robuste und resiliente Plattformen für den zuverlässigen Betrieb auch unter herausfordernden Bedingungen zu schaffen.

  • Was wir bieten
  • Flexibilität und Work-Life-Balance: Profitieren Sie von flexiblen Arbeitszeiten, der Möglichkeit zum mobilen Arbeiten und einem hybriden Arbeitsmodell.
  • Attraktive Vergütung: Ein wettbewerbsfähiges Gehaltspaket, das Ihre Expertise und Leistung honoriert.
  • Entwicklungsmöglichkeiten: Zugang zu umfangreichen Weiterbildungsangeboten, Schulungen und Karriereentwicklungsprogrammen.
  • Modernes Arbeitsumfeld: Arbeiten Sie in einer modernen Ausstattung mit den neuesten Technologien und Tools.
  • Starke Unternehmenskultur: Eine offene und kollegiale Arbeitsatmosphäre, in der Teamarbeit und gegenseitige Unterstützung großgeschrieben werden.
  • Gesundheit und Wohlbefinden: Angebote zur Gesundheitsförderung und Initiativen, die Ihr Wohlbefinden unterstützen.
  • Zusatzleistungen: Diverse Benefits wie betriebliche Altersvorsorge, Mitarbeiterrabatte und Jobticket-Optionen.

Die Bearbeitung Ihrer Bewerbung kann durch externe Dienstleister in Deutschland erfolgen.

Bewerbungen auf Stellen außerhalb der Deutschen Telekom AG können zudem von Recruitern im europäischen Ausland bearbeitet werden.

Dies gilt auch für die Bearbeitung von Bewerbungen bei Tochtergesellschaften der Deutschen Telekom AG.

Für unsere beamteten Mitarbeiterinnen und Mitarbeiter deshalb folgender

Hinweis: Sie sind nicht verpflichtet, Ihrer Bewerbung personalaktenrelevante Unterlagen, insbesondere Beamtenbeurteilungen, beizufügen.

Es bleibt Ihnen jedoch unbenommen, diese Dokumente freiwillig zur Verfügung zu stellen.

Diese Stelle ist auch in Teilzeit möglich.

Schwerbehinderte Menschen werden bei gleicher Eignung vorrangig berücksichtigt.

Bei fachlichen Fragen wenden Sie sich bitte an thomas. arbeit@t-systems. com https://www. xing. com/companies/deutschetelekomag https://www. linkedin. com/company/telekom

  • None None
  • #J-18808-Ljbffr

Site Reliability Engineer (SRE) (m/w/d) Arbeitgeber: T-Systems International

Als Arbeitgeber bieten wir Ihnen die Möglichkeit, in einem dynamischen und unterstützenden Team zu arbeiten, das innovative Cloud-Lösungen und modernste Technologien vorantreibt. Mit flexiblen Arbeitszeiten und der Option, bis zu 95 % remote zu arbeiten, fördern wir eine optimale Work-Life-Balance. Zudem investieren wir in Ihre persönliche und berufliche Entwicklung durch vielfältige Weiterbildungsmöglichkeiten und klare Karrierepfade innerhalb unseres global agierenden Unternehmens.

T

Kontaktdaten:

T-Systems International Recruiting-Team

StudySmarter Expertenrat🤫

Wir sind der Meinung, dass du so Site Reliability Engineer (SRE) (m/w/d) erhalten könntest

Engagier dich in Entwickler-Communities!

Lass uns mal ehrlich sein: In der Software-Entwicklung sind Netzwerke Gold wert! Tummel dich in GitHub-Projekten, nehme an lokalen Meetups oder Hackathons teil und vernetze dich mit anderen Entwicklern. So steigerst du nicht nur deine Sichtbarkeit, sondern lernst auch die neuesten Trends und Technologien kennen.

Zeig deine Fähigkeiten!

Erstelle ein Portfolio, das deine besten Projekte und Code-Examples zeigt. Nichts überzeugt mehr als ein praktischer Beweis deiner Skills. Das kann auch helfen, bei T-Systems International anzuklopfen, wenn du dich auf die Stelle als Site Reliability Engineer (SRE) (m/w/d) bewirbst – so wissen sie gleich, was sie von dir erwarten können!

Nutze Jobplattformen speziell für Tech-Jobs!

Plattformen wie Stack Overflow Jobs oder AngelsList sind perfekte Orte, um Vollzeitstellen in der Software-Entwicklung zu finden. Hier sind viele tolle Unternehmen auf der Suche nach Talenten wie uns, also schau regelmäßig vorbei und bewirb dich direkt über die Website.

Such dir Mentoren und Feedback!

Hol dir Feedback von erfahrenen Entwicklern, die dir Tipps geben können, was Recruiter wirklich suchen. Ob über LinkedIn oder persönliche Kontakte: Menschen, die sich in der Branche auskennen, können enorm wertvoll sein, um dir zu helfen, dich optimal auf deine Bewerbung bei T-Systems International vorzubereiten!

Wir glauben, dass du diese Fähigkeiten brauchst, um Site Reliability Engineer (SRE) (m/w/d) mit Bravour zu bestehen

Monitoring & Observability
Prometheus
Grafana
Loki
AlertManager
Kubernetes
Cloud Native

Einige Tipps für deine Bewerbung 🫡

Highlights deiner Coding-Skills:In der Software-Entwicklung kommt es auf konkrete Fähigkeiten an. Vergiss nicht, relevante Programmiersprachen und Frameworks in deinen Lebenslauf aufzunehmen. Zeig uns, was du kannst – vielleicht mit einem Link zu deinem GitHub-Profil oder einer Übersicht deiner Side Projects, die deine Programmierkenntnisse illustrieren.

Dokumentation deiner Erfolge:Gerade bei einer Vollzeitstelle in der Software-Entwicklung sind konkrete Ergebnisse Gold wert. Nenn uns Zahlen und Ergebnisse aus deinen vorherigen Projekten. Hast du den Code optimiert oder Systemfehler behoben? Solche Erfolge zeigen, dass du die Sprache der Entwickler sprichst und einen echten Mehrwert bringst.

Attraktive Projektbeschreibungen:Wenn du an Projekten gearbeitet hast, die hervorstechen, beschreibe sie ausführlich in deinem Lebenslauf. Was war das Problem, das du gelöst hast? Welche Technologien hast du eingesetzt? Das gibt uns einen klaren Einblick in deine Herangehensweise und Problemlösungsfähigkeiten.

Motivation zeigen:In deinem Anschreiben solltest du deine Motivation für die Stelle im Bereich Software-Entwicklung bei T-Systems International klar herausstellen. Warum sprichst gerade du die Anforderungen für diese Vollzeitrolle an? Mach deutlich, was dich an der Arbeit bei uns reizt und wie du über das rein Technische hinaus wachsen möchtest.

Wie man sich auf ein Vorstellungsgespräch bei T-Systems International vorbereitet

Technische Vorbereitung auf die Coding-Challenges

In der Software-Entwicklung sind technische Fragen oft ein zentraler Teil des Interviews. Macht euch mit Plattformen wie LeetCode oder HackerRank vertraut, um eure Problemlösungsfähigkeiten zu trainieren. Zeigt im Interview viel Selbstbewusstsein beim Erklären eurer Ansätze!

Das eigene Portfolio im besten Licht präsentieren

Stellt sicher, dass ihr ein aussagekräftiges Portfolio habt, das einige eurer besten Projekte zeigt. Seid bereit, darüber zu sprechen, was eure Rolle war, welche Technologien ihr verwendet habt und welche Herausforderungen es gab. Das gibt den Interviewern einen Einblick in eure praktische Erfahrung.

Teamfähigkeit und Kommunikation betonen

In einer Vollzeit-Position wird Kommunikation im Team sehr wichtig sein. Seid bereit, Beispiele aus der Vergangenheit zu teilen, in denen ihr effektiv im Team gearbeitet habt. Dies zeigt, dass ihr nicht nur technische Fähigkeiten habt, sondern auch gut ins Team passt.

Vorbereitung auf Fragen zur Software-Architektur

Bereitet euch darauf vor, Fragen zur Software-Architektur zu beantworten. Themen wie RESTful APIs, Microservices und Cloud-Architekturen können Teil eures Interviews sein. Zeigt euer Verständnis durch Diskussionen und Beispiele aus eurer bisherigen Arbeit oder Projekte.