Staff Software Engineer - Databases SRE | Germany | Remote

Staff Software Engineer - Databases SRE | Germany | Remote

Vollzeit 109709 - 131651 € / Jahr (geschätzt) Kein Homeoffice möglich
Grafana Labs

Auf einen Blick

  • Aufgaben: Entwickle zuverlässige Cloud-Datenbanken und arbeite an spannenden Projekten.
  • Unternehmen: Grafana Labs, ein innovatives Unternehmen mit offener Kultur und globalem Team.
  • Vorteile: 100% remote, wettbewerbsfähiges Gehalt, Aktienoptionen und 30 Tage Urlaub.
  • Weitere Informationen: Wachsendes Unternehmen mit klaren Karrierechancen und einem unterstützenden Team.
  • Warum dieser Job: Gestalte die Zukunft der Datenverfügbarkeit und arbeite mit modernster Technologie.
  • Qualifikationen: Mindestens 8 Jahre Erfahrung in der Softwareentwicklung, idealerweise im SRE-Bereich.

Das prognostizierte Gehalt liegt zwischen 109709 - 131651 € pro Jahr.

Grafana Labs, das Unternehmen hinter der offenen Observability-Cloud, basiert auf den Prinzipien von Open Source, offenen Standards, offenen Ökosystemen und offener Kultur. Grafana Cloud, unsere vollständig verwaltete Observability-Plattform, ist flexibel und skalierbar. Mit der tatsächlich nützlichen KI von Grafana Cloud können Organisationen alle ihre unterschiedlichen Daten sehen, verstehen und darauf reagieren, um mit der Geschwindigkeit ihrer Ambitionen voranzukommen. Heute vertrauen mehr als 35 Millionen Nutzer und über 7.000 Kunden – darunter Anthropic, Bloomberg, NVIDIA, Microsoft und Salesforce – Grafana Labs, um die Zuverlässigkeit ihrer Anwendungen und Systeme sicherzustellen, Vorfälle schnell zu lösen und ihre Telemetrie zu optimieren, um Lärm und Kosten zu reduzieren. Wir sind ein 100% remote Unternehmen mit über 1.600 Teammitgliedern in mehr als 40 Ländern und werden von führenden Investoren wie Lightspeed Venture Partners, Sequoia Capital, GIC, Coatue, J.P. Morgan, CapitalG und Lead Edge Capital unterstützt. Wir wachsen schnell und bleiben dabei unseren Unterschieden treu: einem Open-Source-Erbe, einer globalen kollaborativen Kultur und einer Leidenschaft für sinnvolle Arbeit. Unser Team gedeiht in einer innovationsgetriebenen Umgebung, in der Transparenz, Autonomie und Vertrauen alles antreiben, was wir tun.

Wir suchen einen Staff Software Engineer - SRE, um unsere wertvollsten Grafana Cloud-Kunden zu unterstützen, indem wir die Zuverlässigkeit unserer Cloud-Datenbanken erhöhen, die auf Mimir, Loki, Tempo und Pyroscope basieren. Wir bieten diese Datenbanken als SaaS-Produkt von AWS, GCP und Azure in allen Regionen an. Das SRE-Team ist in die Mimir-, Loki- und Tempo-Teams eingebettet und konzentriert sich darauf, sicherzustellen, dass die Datenbankprodukte von Grafana Cloud außergewöhnliche Zuverlässigkeit für unsere Kunden mit hohen SLA bieten.

In dieser Rolle werden Sie:

  • Eng mit Produktentwicklungsteams zusammenarbeiten (eingebettetes Modell)
  • Die Produktionszuverlässigkeit für komplexe Kundenumgebungen mit hohen SLA übernehmen
  • Automatisierung entwerfen und implementieren, um unsere Zuverlässigkeitspraktiken zu skalieren
  • Sicherstellen, dass unsere Kunden unsere SLO-Ziele erreichen
  • Per-Tenant-SLOs und Zuverlässigkeitsmodelle definieren und weiterentwickeln
  • Proaktiv SLO-Burn reduzieren, um wiederholte Vorfälle zu verhindern
  • Als primärer Eskalationspunkt und Bereitschaftsdienst für relevante Vorfälle fungieren
  • Kundenrelevante Vorfallreaktionen und Nachbesprechungen leiten
  • Zu Entwurfsdokumenten und Code-Reviews beitragen
  • Die Funktionalitätsgestaltung beeinflussen, um Produktionsskalierbarkeit und -betriebsfähigkeit sicherzustellen
  • Automatisierung zur Beseitigung von Aufwand dort aufbauen, wo es nötig ist
  • Die Alarmqualität verbessern und laute Eskalationen reduzieren

Wir suchen einen Staff Software Engineer, der an der Schnittstelle zwischen Kundenbedürfnissen, Produktionssystemen und Produktentwicklung arbeitet. Wir investieren stark in die Produktivität der Entwickler. Sie können moderne KI-Coding-Assistenten als Teil Ihres täglichen Workflows verwenden (Ihre Wahl der Werkzeuge, innerhalb der Sicherheitsrichtlinien), unterstützt durch ein vom Unternehmen finanziertes Nutzungsetat, damit Sie schnell iterieren können, ohne unnötige Reibung. Wir fördern pragmatische KI-unterstützte Entwicklung: schnellere Prototypen, Testgenerierung, Refaktorisierungen, Dokumentation und Nachverfolgung von Vorfällen – immer gepaart mit starken Code-Review- und Qualitätsstandards.

Was wir suchen:

  • Über 8 Jahre Erfahrung in der Ingenieurwissenschaft, davon über 4 Jahre in SRE/CRE/Produktionsengineering.
  • Starke Präferenz für Personen mit formaler Erfahrung im Bereich Kundenzuverlässigkeitsengineering.
  • Starke Kubernetes-Erfahrung in AWS, GCP oder Azure sowie Vertrautheit mit Infrastructure-as-Code-Tools (Helm, Terraform, Jsonnet usw.).
  • Starke Erfahrung in technischer Führung, Leitung eines Teams durch Projekte, Mentoring anderer Ingenieure im Team und als Multiplikator fungieren.
  • Erfahrung im Betrieb von Multi-Tenant-Systemen in der Produktion.
  • Starke Erfahrung in der Gestaltung und Implementierung von SLOs.
  • Erfahrung mit einer oder mehreren Programmiersprachen (z.B. Go, Python, Java usw.).
  • Erfahrung mit den Interna von Linux-Betriebssystemen sowie Grundkenntnisse in Netzwerken, Cloud-Speicher und Skalierung.
  • Ausgezeichnete Problemlösungs- und Fehlersuchefähigkeiten.
  • Erfahrung in der ruhigen und aktiven Teilnahme an beschwerdefreien Vorfallreaktionen, Nachverfolgung von Maßnahmen und Erstellung hochwertiger PIRs (Post-Incident Reviews).
  • Fähigkeit, über Leistung, Skalierung und Fehlermodi nachzudenken.
  • Komfortables Arbeiten innerhalb eines Ingenieurteams, in dem die Einzelnen ermutigt werden, ein starkes Gefühl von Autonomie und Selbstbestimmung zu haben.
  • Fähigkeit, eng mit Produktentwicklungsteams zusammenzuarbeiten.

Ihr Arbeitsalltag wird Folgendes umfassen:

  • Regelmäßige 1:1-Gespräche mit Ihrem Manager und Kollegen
  • Überprüfung und Erstellung von SLOs, proaktive Untersuchung von Möglichkeiten zur weiteren Reduzierung des Budgetverbrauchs für diese SLOs, die selbstgesteuert oder aus Erkenntnissen aus Vorfällen resultieren können und Verbesserungen in der Überwachung, Automatisierung, Erhöhung der Selbstheilung, Auto-Skalierung usw. umfassen können.
  • Verbesserung der Beobachtbarkeit von Kunden in ihren Umgebungen.
  • Entwurf und Implementierung von Lösungen, um die Zuverlässigkeit und Skalierbarkeit unserer Umgebungen sicherzustellen, die den schnell steigenden Anforderungen gerecht werden können.
  • Entwicklung fehlertoleranter Entwurfsmuster, um sicherzustellen, dass wir die Zuverlässigkeit in allen Phasen des Service-Lebenszyklus berücksichtigen.
  • Zusammenarbeit mit unseren Engineering-Leitern, um Produktstrategien, Fahrpläne und technische Designs zu definieren und zu beeinflussen.
  • Teilnahme an PR-Überprüfungen und Zusammenarbeit mit anderen Ingenieuren an ihren Entwurfsdokumenten.
  • Anderen über Site Reliability Engineering beibringen und bewährte Verfahren kommunizieren, die frühzeitig in der Entwicklung neuer Funktionen und Funktionalitäten angewendet werden sollen.
  • Teilnahme an Vorfallreaktionen, wenn zutreffend, einschließlich Untersuchung bis zur Lösung, PIR und Kommunikation mit Kunden über Bridge-Anrufe, wenn erforderlich.

In Deutschland liegt die Basisvergütungsspanne für diese Rolle bei 109.709 € - 131.651 €. Die tatsächliche Vergütung kann je nach Niveau, Erfahrung und Fähigkeiten variieren, die im Interviewprozess bewertet werden. Zu den Vorteilen gehören Eigenkapital, Bonus (falls zutreffend) und andere hier aufgeführte Vorteile.

Warum Sie bei Grafana Labs gedeihen werden:

  • 100% Remote, globale Kultur - Als reines Remote-Unternehmen bringen wir Talente aus der ganzen Welt zusammen, vereint durch eine Kultur der Zusammenarbeit und des gemeinsamen Zwecks.
  • Wachsendes Unternehmen – Bewältigen Sie bedeutungsvolle Arbeit in einer sich schnell entwickelnden Umgebung.
  • Transparente Kommunikation – Erwarten Sie offene Entscheidungsfindung und regelmäßige unternehmensweite Updates.
  • Innovationsgetrieben – Autonomie und Unterstützung, um großartige Arbeit zu leisten und neue Dinge auszuprobieren.
  • Open Source-Wurzeln – Auf gemeinschaftlich orientierten Werten aufgebaut, die prägen, wie wir arbeiten.
  • Ermächtigte Teams – Hochvertrauens-, niedriges Ego-Kultur, die Ergebnisse über Optik stellt.
  • Karrierewachstumswege – Definierte Möglichkeiten, um Ihre Karriere zu entwickeln und zu wachsen.
  • Anschauliche Führung – Transparente Führungskräfte, die involviert, sichtbar und menschlich sind.
  • Leidenschaftliche Menschen – Treten Sie einem Team von klugen, unterstützenden Menschen bei, die sich leidenschaftlich für das einsetzen, was sie tun.
  • Persönliche Einarbeitung - Wir möchten, dass Sie ab dem ersten Tag mit Ihren neuen 'Grafanistas' gedeihen, um alles über das, was wir tun und wie wir es tun, zu lernen.
  • Balance ist wichtig - Wir betreiben eine globale jährliche Urlaubsrichtlinie von 30 Tagen pro Jahr. 3 Tage Ihres Jahresurlaubs sind für Grafana Shutdown Days reserviert, um dem Team wirklich zu ermöglichen, sich zu trennen.

Gleichstellungschancen: Grafana Labs ist ein Arbeitgeber, der Chancengleichheit bietet. Wir begrüßen Bewerbungen von allen, unabhängig von Rasse, Farbe, Nationalität, Herkunft, Kaste, Geschlecht, Geschlechtsidentität oder -ausdruck, sexueller Orientierung, Alter, Religion oder Glauben, Behinderung, Veteranenstatus, genetischen Informationen, Schwangerschaft, Mutterschaft, Familien- oder Betreuungsstatus oder einer anderen Eigenschaft, die durch das lokale Recht geschützt ist. Wir glauben, dass Gleichheit und Vielfalt eine starke Organisation aufbauen, und wir arbeiten hart daran, dies als Grundlage unserer Organisation sicherzustellen, während wir wachsen.

Staff Software Engineer - Databases SRE | Germany | Remote Arbeitgeber: Grafana Labs

Grafana Labs ist ein hervorragender Arbeitgeber, der eine 100% remote Arbeitsumgebung bietet und Talente aus der ganzen Welt vereint. Mit einer innovationsgetriebenen Kultur, transparenten Kommunikationswegen und klaren Karrierewachstums-Pfaden fördert das Unternehmen eine hohe Vertrauenskultur, in der Mitarbeiter ermutigt werden, bedeutende Arbeit zu leisten und neue Ideen auszuprobieren. Die Möglichkeit, an einem dynamischen, wachstumsorientierten Unternehmen teilzuhaben, gepaart mit einem globalen jährlichen Urlaubsanspruch von 30 Tagen, macht Grafana Labs zu einem attraktiven Arbeitsplatz für alle, die nach sinnvollen und lohnenden Beschäftigungsmöglichkeiten suchen.

Grafana Labs

Kontaktdaten:

Grafana Labs Recruiting-Team

Wir glauben, dass du diese Fähigkeiten brauchst, um Staff Software Engineer - Databases SRE | Germany | Remote mit Bravour zu bestehen

Site Reliability Engineering (SRE)
Kubernetes
AWS
GCP
Azure
Infrastructure-as-Code (Helm, Terraform, Jsonnet)
Technical Leadership