Auf einen Blick
- Aufgaben: Leite komplexe Produktionsvorfälle und entwickle innovative Cloud-Architekturen.
- Unternehmen: Wachsendes Unternehmen im Bereich Geschäftsanwendungen mit einer inklusiven Kultur.
- Vorteile: Attraktives Gehalt, 22 Tage Urlaub, Gesundheitsleistungen und flexible Arbeitsmöglichkeiten.
- Weitere Informationen: Dynamisches Umfeld mit großartigen Karrierechancen und einem engagierten Team.
- Warum dieser Job: Gestalte die Zukunft der Technologie und arbeite an spannenden Projekten.
- Qualifikationen: Mindestens 8 Jahre Erfahrung in Site Reliability Engineering und Cloud-Infrastruktur.
Das prognostizierte Gehalt liegt zwischen 185000 - 185000 € pro Jahr.
Wir suchen Menschen, die zur Access-Familie gehören und unsere Leidenschaft für eine bessere Zukunft teilen. Wir bieten einen gemischten Ansatz für die Büroarbeit, der Sie ermutigt, in einem unserer florierenden Büros zusammenzuarbeiten und sich zu vernetzen. Wir nehmen die Entwicklung unserer Mitarbeiter ernst und arbeiten mit Ihnen an Ihrem Erfolg. Neben einem wettbewerbsfähigen Gehalt erhalten Sie 22 Tage bezahlten Urlaub sowie 11 bezahlte Feiertage. Außerdem bieten wir medizinische, zahnärztliche und augenärztliche Versicherungen, eine 5%ige 401(k)-Unternehmensbeteiligung und eine Reihe weiterer wählbarer Vorteile.
Über Sie: Sie denken in Systemen, nicht nur in Technologien. Sie sind der Ingenieur, zu dem Ihre Kollegen flüchten, wenn das Problem schwierig ist. Sie sind sowohl im Entwerfen von Cloud-Architekturen als auch im Führen komplexer P1-Vorfälle zu Hause und schreiben das Terraform-Modul, das sicherstellt, dass es nie wieder passiert. Sie bringen Disziplin in Nachbesprechungen nach Vorfällen, Dringlichkeit bei Produktionsproblemen und echte Zufriedenheit in die ruhigeren Arbeiten — ein sauberes Runbook, ein gut strukturiertes SLO, ein Stück Arbeit, das nicht mehr existiert. Sie trennen Strategie nicht von Betrieb und verstehen, dass die besten Site Reliability Engineers beides jeden Tag auf einem hohen Niveau tun.
Sie sind ein klarer Kommunikator, der eine technische Architekturüberprüfung mit Ingenieuren leiten kann und dann dieselbe Entscheidung einem leitenden Stakeholder erklären kann, ohne dabei das Publikum zu verlieren. Sie führen durch Glaubwürdigkeit, beeinflussen ohne Autorität und übernehmen Verantwortung für Ergebnisse — nicht nur für Aufgaben. Wenn sich das nach Ihrer Arbeitsweise anhört, würden wir uns freuen, mit Ihnen zu sprechen.
Tag für Tag werden Sie:
- Als seniorer Eskalationspunkt für komplexe Produktionsvorfälle (P1/P2) fungieren, die systemübergreifende Triage leiten und dauerhafte architektonische Lösungen entwickeln.
- Plattformübergreifende Architekturüberprüfungen leiten und sicherstellen, dass die Designs der Cloud-Infrastruktur den Anforderungen an Zuverlässigkeit, Skalierbarkeit, Sicherheit und Betrieb entsprechen.
- Systematische Fehlerquellen über Vorfälle hinweg identifizieren und in architektonische Änderungen, Designstandards und nachhaltige Plattformverbesserungen umsetzen.
- Die Verfügbarkeit, Zuverlässigkeit, Leistung und Skalierbarkeit von Produktionssystemen täglich verwalten.
- Service Level Objectives (SLOs), Service Level Indicators (SLIs) und betriebliche KPIs über kritische Dienste definieren, verfolgen und verbessern.
- Infrastructure-as-Code (IaC)-Lösungen mit Terraform entwickeln und pflegen, einschließlich Modulentwurf, Zustandsverwaltung und Governance-Standards.
- Operative Belastungen systematisch durch Automatisierung, Self-Service-Funktionen und plattformübergreifende Tools beseitigen.
- Automatisierungsrahmen und betriebliche Tools mit Bash, PowerShell und verwandten Skripting-Technologien erstellen und pflegen.
- Microsoft Azure als primäre Cloud-Plattform verwalten und architektonische Lösungen entwerfen, mit Kenntnissen in AWS.
- Kubernetes in der Produktion betreiben, einschließlich Clusterverwaltung, Arbeitslastoperationen und plattformübergreifender Wartung.
- Hybrid-Cloud-Umgebungen verwalten, einschließlich virtueller Maschinen, Netzwerke und verteilte Infrastruktur.
- Datadog-Observabilität und PagerDuty-Alarmkonfigurationen pflegen und die Standards für Observabilität über Metriken, Protokollierung, Nachverfolgung und Alarmierung fördern.
- Infrastrukturkontrollen entwerfen, die den Anforderungen an PCI-DSS, SOC 1/2 und ISO 27001 entsprechen, und die Beweissammlung während Audits unterstützen.
- Mit Engineering-, Produkt-, Sicherheits- und Betriebsteams zusammenarbeiten, um CI/CD-Pipelines, Freigabeprozesse und die allgemeine DevOps-Reife zu verbessern.
- Kollegen und Junior-Ingenieure betreuen und die technischen Standards der Organisation als interne technische Autorität für Infrastrukturdesign beeinflussen.
Ihre Fähigkeiten und Erfahrungen könnten auch Folgendes umfassen:
- 8+ Jahre Erfahrung in Site Reliability Engineering, Platform Engineering oder Infrastructure Engineering mit direkter Verantwortung für komplexe Produktionsplattformen in großem Maßstab.
- Nachweisliche Erfolge als seniorer technischer Eskalationspunkt für teamübergreifende Vorfälle, die architektonische Entscheidungen und dauerhafte Lösungen erforderten.
- Expertenkenntnisse im Entwerfen und Betreiben von Cloud-Infrastrukturen in Microsoft Azure, mit Kenntnissen in AWS.
- Tiefe Expertise im Betrieb von Kubernetes in der Produktion — Clusterdesign, Arbeitslastoperationen und plattformübergreifende Wartung.
- Fortgeschrittene Terraform- und Infrastructure-as-Code (IaC)-Fähigkeiten, einschließlich Modulentwurf, Zustandsverwaltung und Governance.
- Starke Bash-Skripting- und Automatisierungsentwicklung für betriebliche Tools und Self-Service-Plattformfunktionen.
- Solide Netzwerkgrundlagen: Firewalls, DNS, Routing, VPN und Netzwerkfehlerbehebung, einschließlich Cloudflare-Edge-Dienste.
- Active Directory-Verwaltung und hybride Identitätserfahrung.
- Praktische Erfahrung im Entwerfen von CI/CD-Pipelines und der Verbesserung von Bereitstellungsabläufen in einer DevOps-Umgebung.
- Erfahrung mit Datadog, PagerDuty oder einer gleichwertigen Plattform für Observabilität und Alarmierung.
- Erfahrung in einem regulierten Umfeld, einschließlich PCI-DSS, SOC 1/2 und ISO 27001.
- Starke Eigenverantwortung mit der Fähigkeit, über organisatorische Grenzen hinweg ohne direkte Autorität Einfluss zu nehmen.
Bevorzugt:
- Verwaltung von Puppet oder einer gleichwertigen Plattform für Konfigurationsmanagement.
- Verwaltung von Microsoft SQL Server-Umgebungen.
- Verwaltung von Meraki-Firewall-Richtlinien.
- Hintergrund in KI-gesteuerten Betriebsabläufen und der Entwicklung des Model Context Protocol (MCP).
- Führung von internen Entwicklerplattformen (IDP) oder Initiativen im Bereich Plattformengineering.
- Unterstützung von SaaS in großem Maßstab oder hochverfügbaren Plattformen.
- Kenntnisse im Scala- und/oder Java-Anwendungsökosystem auf Infrastrukturebene.
- Zertifizierungen als Azure Solutions Architect Expert, Azure Administrator Associate, AWS Solutions Architect oder CKA.
Die Bewerber müssen in den östlichen oder zentralen Zeitzonen wohnen, um eine Abstimmung mit unseren Kernarbeitszeiten und eine effektive Zusammenarbeit mit unserem Team zu gewährleisten. Eine Genehmigung zur Arbeit in den USA ohne Arbeitgeberunterstützung ist für diese Gelegenheit erforderlich. Die erwartete Grundgehaltsbandbreite für diese Position liegt zwischen 165.000 und 185.000 USD jährlich. Die endgültige Vergütung wird auf der Grundlage verschiedener Faktoren, einschließlich Standort, Qualifikationen, Erfahrung und Fähigkeiten, festgelegt. Alle Vergütungen außerhalb des angegebenen Rahmens werden gemäß den geltenden Gesetzen und Unternehmensrichtlinien bestimmt.
Was sind wir? Die Access Group ist einer der größten Anbieter von Geschäftsanwendungssoftware mit Hauptsitz im Vereinigten Königreich. Wir bieten Lösungen, die mehr als 160.000 kleinen und mittelständischen Unternehmen in den Bereichen Handel und Non-Profit in Europa, den USA und APAC ermöglichen, mehr von dem zu tun, was wichtig ist. Unsere innovativen Cloud-Lösungen und integrierten KI-Softwareerfahrungen über mehrere Access-Produkte hinweg verändern, wie Geschäftstechnologie genutzt wird. Mit über 9.300 talentierten Mitarbeitern, die Innovation und Kundenzufriedenheit vorantreiben, gestalten wir die Zukunft der Arbeit. Und wir möchten, dass Sie Teil davon sind. Bei Access stehen die Menschen im Mittelpunkt unseres Handelns. Wir setzen uns dafür ein, eine inklusive, leistungsstarke Kultur zu schaffen, in der sich jeder geschätzt, respektiert und befähigt fühlt, zu gedeihen. Wenn Sie sich für diese Rolle begeistern - auch wenn Ihre Erfahrung nicht jede Anforderung erfüllt - könnten Sie genau die Person sein, die wir suchen. Wir glauben an Gleichheit für alle und die transformative Kraft der Vielfalt. Warum also nicht Teil unseres lebhaften Teams werden, wo Sie lieben können, was Sie tun, lieben können, wie Sie leben, und vor allem authentisch Sie selbst sein können? Lassen Sie uns gemeinsam einen Unterschied machen. Liebe Arbeit. Liebe Leben. Sei du selbst.
Senior Site Reliability Engineer Arbeitgeber: The Access Group
Die Access Group ist ein hervorragender Arbeitgeber, der seinen Mitarbeitern nicht nur ein wettbewerbsfähiges Gehalt und 25 Tage Urlaub bietet, sondern auch eine Vielzahl von Vorteilen, die auf individuelle Bedürfnisse zugeschnitten sind. Unsere Unternehmenskultur fördert Zusammenarbeit und Kreativität in einem dynamischen Umfeld, während wir gleichzeitig ernsthaft in die Entwicklung unserer Mitarbeiter investieren, um deren Karriere voranzutreiben. Mit einem klaren Fokus auf Vielfalt und Inklusion schaffen wir einen Arbeitsplatz, an dem jeder gedeihen kann und die Möglichkeit hat, einen positiven Einfluss zu nehmen.