Senior Site Reliability Engineer (all genders)

Senior Site Reliability Engineer (all genders)

Berlin Vollzeit 51750 - 63250 € / Jahr (geschätzt) Homeoffice (teilweise)
F

Auf einen Blick

  • Aufgaben: Gestalte die Transformation zu einer modernen SaaS-Company und sorge für zuverlässige Systeme.
  • Unternehmen: Innovatives Unternehmen im eCommerce mit modernster Product-Discovery-Technologie.
  • Vorteile: Flexibles Arbeiten, modernes Tech-Stack und Raum für persönliche Entwicklung.
  • Weitere Informationen: Starkes Team mit offener Feedback-Kultur und Fokus auf Automatisierung.
  • Warum dieser Job: Direkter Einfluss auf führende eCommerce-Marken und spannende Herausforderungen in der Cloud.
  • Qualifikationen: Erfahrung als SRE oder starkes Interesse an der Rolle mit solidem technischen Hintergrund.

Das prognostizierte Gehalt liegt zwischen 51750 - 63250 € pro Jahr.

Introduction FACT-Finder entwickelt Product-Discovery-Technologie für den e Commerce und ist mit den Produkten Next Generation und Infinity bei führenden Online-Shops in Europa im Einsatz.

Beide Produkte bewegen sich aktuell in Richtung einer modernen, hybriden Plattform auf Basis von Kubernetes und Harvester – mit der Option, mittelfristig vollständig in die Cloud zu skalieren.

Als Senior Site Reliability Engineer (SRE) sorgst du dafür, dass unsere Systeme über diese Transformation hinweg schnell, verfügbar und skalierbar bleiben.

Du arbeitest mit dem Hosting-Team und erfahrenen Engineers zusammen und gestaltest den Weg zu einer modernen Saa S-Company aktiv mit.

Deine Aufgaben Du definierst und verantwortest SLOs, SLIs und Error Budgets über beide Produkte hinweg und triffst datenbasierte Entscheidungen zu Reliability und Performance.

Du treibst Incident Response voran: schnelle Detektion, klare Kommunikation, blameless Postmortems und nachhaltige Follow-ups.

Du reduzierst manuelle Arbeit konsequent durch Automatisierung und Git Ops (z.

Argo CD / Flux) und baust self-healing sowie self-service Fähigkeiten aus.

Du unterstützt den Aufbau eines NG Search Operators (Custom Kubernetes Operator / CRDs) und die Einführung von Auto-Scaling (HPA, VPA, KEDA, Cluster Autoscaler).

Du entwickelst unsere Observability weiter – Metrics, Logs, Traces, Alerting und Runbooks, die on-call wirklich helfen.

Du planst Kapazität und Kosten über On-Premise (Frankfurt, Stockholm) und Cloud hinweg – inklusive Burst-Szenarien in die Public Cloud.

Du nutzt AI-Tools, um Diagnose, Alerting und operative Workflows spürbar zu Dein Profil Erfahrung als SRE, Infrastructure oder Production Engineer in einem Saa S- oder Plattform-Umfeld – oder ein starker Software-/Operations-Hintergrund mit klarem Willen, in die SRE-Rolle hineinzuwachsen.

Solides Verständnis von SLOs, Error Budgets, Incident Management und Observability.

Hands-on Erfahrung mit Kubernetes und Interesse an Cluster-Lifecycle, Upgrades und Operator-Pattern.

Erfahrung oder starkes Interesse an Harvester bzw. vergleichbaren HCI-/Virtualisierungsplattformen (Kube Virt, v Sphere/ESXi, Open Stack).

Vertrautheit mit Git Ops (Argo CD / Flux), Container Storage (Longhorn, Ceph) und Kubernetes Networking (Load Balancing, Ingress).

Kenntnisse zu Auto-Scaling-Primitiven (HPA, VPA, Cluster Autoscaler, KEDA) und Kapazitätsplanung on-prem und in der Cloud.

Verständnis für Netzwerke in produktionsnahen Rechenzentren (u. a.

VLAN).

Ausgeprägter Automatisierungsinstinkt und eine Haltung, Toil strukturell zu eliminieren.

Praktische Erfahrung im Einsatz von AI-Tools im operativen Betrieb.

Sehr gute Englischkenntnisse; Deutsch von Vorteil.

THE JOY OF WORKING WITH US Impact from day one: Deine Arbeit wirkt direkt auf die Umsätze führender e Commerce-Marken in Europa.

Moderner Tech-Stack: Kubernetes, Harvester, Git Ops, Auto-Scaling und ein spannender Weg in Richtung Cloud – mit Raum, Dinge neu und richtig zu bauen.

AI-first

Mindset: Wir nutzen AI nicht als Buzzword, sondern als festen Bestandteil unserer täglichen Arbeit.

Ownership & Wachstum: Klare Verantwortung, kurze Entscheidungswege und die Möglichkeit, deine Rolle aktiv mitzugestalten.

Flexibles

Arbeiten: Hybrides Arbeitsmodell mit Fokus auf Ergebnisse.

Starkes

Team: Erfahrene Engineers, offene Feedback-Kultur und ein Umfeld, in dem Reliability als Engineering-Disziplin ernst genommen wird.

Standort Berlin, München, Pforzheim oder Stockholm (Hybrid)

Senior Site Reliability Engineer (all genders) Arbeitgeber: FactFinder

Als Account Executive für den italienischen Markt bieten wir Ihnen die Möglichkeit, in einem dynamischen und innovativen Umfeld zu arbeiten, das auf Wachstum und Zusammenarbeit setzt. Unsere Unternehmenskultur fördert Autonomie und Vertrauen, während Sie mit führenden eCommerce-Unternehmen in Italien zusammenarbeiten und Ihre Karriere durch transparente Vergütungsstrukturen und schnelle Aufstiegsmöglichkeiten vorantreiben können. Genießen Sie die Vorteile eines modernen Arbeitsumfelds in Berlin oder Pforzheim, wo Sie Teil eines erstklassigen Teams sind und an der Spitze der eCommerce- und KI-Revolution stehen.

F

Kontaktdaten:

FactFinder Recruiting-Team

Wir glauben, dass du diese Fähigkeiten brauchst, um Senior Site Reliability Engineer (all genders) mit Bravour zu bestehen

SRE Erfahrung
Infrastructure Engineering
Production Engineering
SaaS-Umfeld
SLOs Verständnis
Error Budgets
Incident Management