Senior Site Reliability Engineer (m/f/d)

Senior Site Reliability Engineer (m/f/d)

Vollzeit 60000 - 80000 € / Jahr (geschätzt) Kein Homeoffice möglich
F

Auf einen Blick

  • Aufgaben: Übernehme die Verantwortung für die Zuverlässigkeit unserer Plattform und leite technische Entscheidungen.
  • Unternehmen: Flip, die führende KI-gestützte Plattform für Mitarbeitererfahrungen.
  • Vorteile: Flexibles Arbeiten, E-Gym-Mitgliedschaft und Jobrad-Leasing.
  • Weitere Informationen: Remote-first Kultur mit regelmäßigen Team-Events und Entwicklungsmöglichkeiten.
  • Warum dieser Job: Gestalte die Zukunft der Arbeit mit modernster Technologie und wachse in einem dynamischen Team.
  • Qualifikationen: Mindestens 5 Jahre Erfahrung in Site Reliability Engineering oder verwandten Bereichen.

Das prognostizierte Gehalt liegt zwischen 60000 - 80000 € pro Jahr.

Unsere Mission ist es, die weltweit am häufigsten genutzte KI-Plattform für Mitarbeitererfahrungen zu sein, indem wir die Art und Weise verändern, wie Frontmitarbeiter arbeiten. Flip ist die führende KI-gestützte Plattform für Mitarbeitererfahrungen im Bereich der Frontmitarbeiter. Wir transformieren, wie Menschen in den Branchen arbeiten, die die Welt am Laufen halten: Einzelhandel, Fertigung und Logistik. Eine App. Ein Touch. Alles, was sie brauchen.

Als Senior Site Reliability Engineer in unserem Platform Squad sind Sie verantwortlich für kritische Zuverlässigkeitsbereiche von Anfang bis Ende und treiben die technische Richtung innerhalb des Teams voran - führen architektonische Entscheidungen auf unserer Plattform, betreuen Teamkollegen und heben kontinuierlich die Zuverlässigkeitsstandards innerhalb des Teams an. Diese Rolle richtet sich an einen Ingenieur mit nachweislicher Erfahrung im Aufbau und Betrieb von hochdurchsatzfähigen, hochverfügbaren Systemen, der eine senior-level technische Verantwortung und echten Einfluss durch tiefgehende Ingenieurtätigkeiten innerhalb eines kompakten, gut definierten Teams wünscht.

Was Sie bei uns erwartet:

  • Co‑own the architecture: Helfen Sie, die Architektur und Evolution unserer Cloud-Infrastruktur auf Azure und unsere Kubernetes-Cluster zu gestalten - entworfen für hohen Durchsatz und höchste Verfügbarkeit - um Flips schnelles Wachstum weltweit zu unterstützen.
  • Drive the resilience strategy: Definieren Sie, wie wir globales Scaling, Zero-Downtime-Deployments, Rollback-Mechanismen und Notfallwiederherstellung angehen, und stellen Sie sicher, dass die Plattform rund um die Uhr verfügbar bleibt.
  • Evolve our observability stack: Verbessern Sie unseren LGTM-Stack (Loki, Grafana, Tempo, Mimir) zu einer Grundlage, auf die unsere Ingenieure vertrauen können.
  • Improve our IaC Platform: Beseitigen Sie unnötige Arbeiten an der Quelle und machen Sie unsere Infrastruktur wirklich selbstbedienbar für Ingenieurteams.
  • Lead in incidents: Übernehmen Sie eine führende Rolle bei plattformbezogenen größeren Vorfällen, leiten Sie fehlerfreie Nachbesprechungen für das Team und übersetzen Sie Erkenntnisse in systematische Verbesserungen.
  • Mentor within the squad: Coachen Sie Teamkollegen, führen Sie RFCs und Design-Reviews im Team durch und helfen Sie Ingenieuren, stärkere SREs zu werden.
  • Shape our roadmap: Arbeiten Sie mit Ihrem Team zusammen, um die Richtung der Plattform zu definieren.

Was Sie mitbringen:

  • Mindestens 5 Jahre praktische Erfahrung als Site Reliability Engineer (SRE), Platform Engineer, DevOps Engineer, Infrastructure Engineer, Cloud Engineer oder Backend Engineer mit starkem Fokus auf Infrastruktur.
  • Nachweisliche Erfahrung im Aufbau und Betrieb von hochdurchsatzfähigen, hochverfügbaren Systemen in der Produktion.
  • Tiefe, produktionsrelevante Erfahrung mit Kubernetes auf einem Hyperscaler.
  • Starke Erfahrung mit modernen Observability-Stacks (z.B. Prometheus, Mimir, VictoriaMetrics, Dash0, Loki, ELK) und eine klare Sichtweise auf SLIs, SLOs und Fehlerbudgets.
  • Solide Softwareentwicklungskompetenzen in Go (stark bevorzugt, da unsere IaC auf Pulumi in Go läuft) oder Python.
  • Praktische Erfahrung mit Infrastructure as Code (Pulumi, OpenTofu, Terraform) und GitOps (z.B. ArgoCD) + CI/CD-Pipeline-Design.
  • Nachgewiesene Fähigkeit, komplexe Infrastrukturinitiativen von der Planung bis zur Produktion zu leiten - einschließlich Schreiben von RFCs und Treffen von Architekturentscheidungen innerhalb Ihres Teams.
  • Erfahrung in der Betreuung von Ingenieuren und der Erhöhung des technischen Niveaus innerhalb eines Teams.
  • Komfortabel im Umgang mit größeren Vorfällen von Anfang bis Ende und in der Umsetzung von Erkenntnissen in systematische Veränderungen.
  • Starke Kommunikationsfähigkeiten und geschäftsfließendes Englisch.
  • Bereitschaft zur Teilnahme an Bereitschaftsdiensten, um die Zuverlässigkeit unserer Plattform sicherzustellen.

Nice-to-Have Qualifikationen:

  • Produktionstaugliche API-Gateways mit Gateway API (z.B. Envoy Gateway) implementiert.
  • Multi-Cluster-Service-Meshes (z.B. Cilium, Linkerd, Istio) betrieben.
  • Kubernetes-Operatoren (z.B. Strimzi, CNPG) bereitgestellt und gewartet.
  • Hochverfügbares PostgreSQL in der Produktion betrieben.

Was wir Ihnen bieten:

  • Arbeitsmodus: Wir sind remote-first und geben Ihnen die Flexibilität, von zu Hause aus zu arbeiten. Gleichzeitig schätzen wir die Kraft der persönlichen Zusammenarbeit. Je nach Rolle nehmen Sie an gelegentlichen Teamevents, Workshops oder Meetings in unseren Büros in Berlin oder Stuttgart teil - immer mit ausreichend Vorankündigung. Das genaue Gleichgewicht wird während Ihres Interviews besprochen.
  • Work-Life-Balance: Wir möchten nicht, dass Sie Wurzeln in Ihrem Schreibtischstuhl schlagen. Deshalb übernehmen wir die Kosten für Ihre E-Gym-Wellpass-Mitgliedschaft und bieten Jobrad-Leasing an.
  • Erfolg feiern: Erwarten Sie hochmotivierte und engagierte Menschen in einer entspannten Arbeitsatmosphäre.
  • Teil von etwas Größerem sein: Sie gestalten Flip aktiv in Ihrer Rolle. Auf dem Weg sind Sie ein Ermöglicher des schnellen Wachstums eines jungen Technologieunternehmens und wachsen in Richtung Ihrer Ziele, Spaß ist garantiert.
  • Happy to be a Flipster: Freuen Sie sich auf regelmäßige Teamevents und Kulturtage, die uns als Flipsters zusammenbringen.
  • Arbeiten im Ausland: Bei Flip können Sie auch im Ausland innerhalb der Europäischen Union arbeiten. Lassen Sie uns im Interview über Remote-Arbeit sprechen.

Bei Flip ist jeder willkommen - unabhängig davon, welches Geschlecht Sie identifizieren oder wie alt Sie sind. Sexuelle Identität, Herkunft, Religion, Weltanschauung und Behinderungen beeinflussen nicht Ihr potenzielles Arbeitsverhältnis bei Flip. Das Wichtigste ist, dass SIE passen!

F

Kontaktdaten:

Flip Recruiting-Team

Wir glauben, dass du diese Fähigkeiten brauchst, um Senior Site Reliability Engineer (m/f/d) mit Bravour zu bestehen

Kubernetes
Cloud Infrastructure (Azure)
Hochverfügbare Systeme
Observability Stacks (z.B. Prometheus, Mimir, Loki)
Infrastructure as Code (Pulumi, Terraform)
GitOps (z.B. ArgoCD)
Softwareentwicklung in Go oder Python