Auf einen Blick
- Aufgaben: Verbessere die Cloud-Infrastruktur und entwickle innovative Lösungen für unsere Plattform.
- Unternehmen: SimScale, ein dynamisches Unternehmen mit einem starken Fokus auf Teamarbeit.
- Vorteile: Flexibles Arbeiten, Gesundheitsleistungen, Weiterbildungsmöglichkeiten und Kinderbetreuungsbeiträge.
- Weitere Informationen: Wachsendes Team mit hervorragenden Karrierechancen und einer offenen Unternehmenskultur.
- Warum dieser Job: Gestalte die Zukunft der Cloud-Technologie und arbeite an spannenden Projekten.
- Qualifikationen: Erfahrung in SRE, Softwareentwicklung und Cloud-Infrastruktur erforderlich.
Das prognostizierte Gehalt liegt zwischen 60000 - 80000 € pro Jahr.
Wir suchen einen Senior SRE / Platform Engineer (m/w/d), der die Cloud-Infrastruktur hinter SimScale's browserbasierter Simulationsplattform verantwortet und verbessert. Die Rolle umfasst AWS und EKS, Observabilität, Notfallwiederherstellung, Sicherheits- und Compliance-Kontrollen, Multi-Region-Architektur, elastische GPU/HPC-Kapazität und interne Entwicklerwerkzeuge.
Verantwortlichkeiten
- Die Engineering-Teams von SimScale führen Workloads direkt auf AWS aus; Sie werden die Standards, Leitplanken und Self-Service-Tools erstellen, die es ihnen ermöglichen, dies sicher zu tun, um Zuverlässigkeit und Sicherheit zu erhöhen, ohne die Ingenieureffizienz zu verlangsamen.
- Sie werden Teil eines kleinen, eng verbundenen Infrastrukturteams, das über 50 Ingenieure im Unternehmen unterstützt.
- Dies ist eine praktische Rolle für einen erfahrenen individuellen Mitwirkenden; Personalmanagement ist nicht erforderlich, aber es gibt einen echten Weg zur technischen Führungsrolle, während das Team wächst.
- Entwickeln Sie unsere Kubernetes-Plattform weiter: Bewerten und übernehmen Sie Technologien wie Kubernetes Gateway API und Service-Mesh-Muster und koordinieren Sie die Plattformentwicklung über mehr als 10 Engineering-Teams.
- Bringen Sie die Observabilität auf die nächste Stufe: Fördern Sie die organisationale Einführung von OpenTelemetry für verteiltes Tracing und Metriken und helfen Sie den Teams, sinnvolle SLOs zu definieren.
- Gestalten Sie die Multi-Region-Architektur und Datenresidenz: Unterstützen Sie unseren Übergang von einem EU-zentrierten Fußabdruck zu einer globalen Multi-Cloud-Architektur, die Anforderungen an Notfallwiederherstellung und Datenresidenz erfüllt.
- Verantworten Sie die Cloud-Kosten und Effizienz im großen Maßstab: Halten Sie die Infrastruktur mit Petabyte-Skala kosteneffizient, sicher und gut instrumentiert.
- Verbessern Sie die Werkzeuge: Erstellen Sie Self-Service-AWS-Konto-Provisionierung, Leitplanken und KI-unterstützte Automatisierungen, die den Ingenieurteams helfen, die Infrastruktur sicher und effizient im großen Maßstab zu verwalten.
Qualifikationen
- Starke Systemgrundlagen: Sie verstehen Linux-Interna und verteilte Systeme gut genug, um komplexes Produktionsverhalten zu debuggen.
- Erfahrung in der Softwareentwicklung: Ihr Hintergrund ist in der Softwareentwicklung verwurzelt, und Sie sind von dort in die SRE-Rolle gewechselt. Sie schreiben produktionsreife Software in mindestens einer der Sprachen Python, Go, Rust oder Java.
- Sicherheits- und Compliance-Bewusstsein: Sie verstehen, wie Infrastrukturentscheidungen den Zugriff, die Auditierbarkeit, die Notfallwiederherstellung, das Logging und Standards wie SOC 2 beeinflussen.
- Produktions-Debugging-Tiefe: Sie können komplexe Fehler untersuchen, klar während Vorfällen kommunizieren und Erkenntnisse in dauerhafte Verbesserungen umsetzen.
- Praktische Cloud- und Infrastruktur-Erfahrung: AWS (oder GCP), deklarative Infrastruktur (Terraform), GitOps-Workflow (ArgoCD) und Container-Orchestrierung (Kubernetes).
- 5+ Jahre Berufserfahrung in SRE, Plattform- oder Infrastrukturengineering.
- Klare Kommunikation: Sie können Trade-offs den Engineering-Teams erklären und anderen helfen, bessere Plattformpraktiken ohne unnötige Reibung zu übernehmen.
- Erfahrung in Observabilität und Zuverlässigkeit: Sie haben mit OpenTelemetry, Prometheus, verteiltem Tracing, Monitoring und sinnvollen SLOs/SLIs gearbeitet.
- Ein Open-Source-Portfolio oder Beiträge.
- Frühere technische Führungserfahrung, insbesondere in Infrastruktur, Zuverlässigkeit oder Plattformengineering.
Vorteile
- Mobiles Arbeiten: Moderne Technologie in Verbindung mit der weit verbreiteten Nutzung digitaler Kommunikation ermöglicht Remote-Arbeit. Wir begrüßen mobiles Arbeiten, da es unseren Mitarbeitern viele Möglichkeiten bietet.
- Wettbewerbsfähige Gesundheitsleistungen: Während Sie in einem wettbewerbsfähigen und ehrgeizigen Umfeld arbeiten, ist es ebenso wichtig, auf Ihre Gesundheit zu achten. Bei SimScale sind Sie abgesichert.
- Vergünstigte Fitnessstudio-Mitgliedschaft: Wir bieten eine Fitnessstudio-Mitgliedschaft mit mehreren Standorten an, um es unseren Mitarbeitern zu erleichtern, in ihre Gesundheit zu investieren, ihr Wohlbefinden zu fördern und regelmäßig zu trainieren.
- Tech Talks und soziale Veranstaltungen: Ob durch Tech Talks, soziale Veranstaltungen oder andere organisierte Aktivitäten, wir arbeiten nicht nur zusammen, sondern teilen auch gerne und genießen die Gesellschaft des anderen.
- Flexible Arbeitszeiten: Es spielt keine Rolle, ob Sie ein Frühaufsteher oder eine Nachteule sind, bei SimScale haben Sie die Freiheit, Ihren Arbeitstag zu planen.
- Lernen und Entwicklung: Mit der richtigen Schulung bieten wir unseren Mitarbeitern die Möglichkeit, ihre Kompetenzen und Fähigkeiten weiterzuentwickeln, um letztendlich erfolgreicher und zufriedener zu werden.
- Beitragszahlungen zur Kinderbetreuung: Neben flexiblen Arbeitszeiten und Homeoffice-Möglichkeiten zur Unterstützung familiärer Verpflichtungen bieten wir auch Beiträge für die Kinderbetreuung in unserer Mini SimScaler-Kita oder im Kindergarten an.
- Altersvorsorge: Wir sind zukunftsorientiert und kümmern uns um unsere Mitarbeiter! Wir bieten unseren Mitarbeitern einen Altersvorsorgeplan, der zu einer komfortablen und sicheren Zukunft beiträgt.
Senior Site Reliability Engineer / Platform Engineer Arbeitgeber: SimScale
SimScale ist ein hervorragender Arbeitgeber, der eine dynamische und kollaborative Arbeitsumgebung bietet, in der Innovation und Teamgeist im Mittelpunkt stehen. Mit einem starken Fokus auf Vielfalt, Chancengleichheit und individuelle Entwicklungsmöglichkeiten fördert das Unternehmen das Wachstum seiner Mitarbeiter und ermöglicht es ihnen, ihre Karriereziele zu erreichen. Die Möglichkeit, remote zu arbeiten und internationale Beziehungen zu pflegen, macht die Position des Enterprise Customer Success Managers besonders attraktiv für Fachkräfte, die in einem zukunftsorientierten Umfeld tätig sein möchten.