Auf einen Blick
- Aufgaben: Leite die Zuverlässigkeitsstrategie für unsere Cloud-Plattform und Produktionsdienste.
- Unternehmen: ID Quantique, ein führendes Unternehmen im Bereich quantensichere Kommunikation.
- Vorteile: Wettbewerbsfähiges Gehalt, flexible Arbeitsmodelle und kontinuierliche Weiterbildung.
- Weitere Informationen: Dynamisches Umfeld mit hervorragenden Karrierechancen und einer leistungsorientierten Kultur.
- Warum dieser Job: Gestalte die Zukunft der quantensicheren Technologien und arbeite mit einem globalen Expertenteam.
- Qualifikationen: Über 15 Jahre Erfahrung in der Produktionstechnik und Führungskompetenz im Site Reliability Engineering.
Das prognostizierte Gehalt liegt zwischen 60000 - 80000 € pro Jahr.
ID Quantique (IDQ) als Teil von IONQ ist ein globaler Marktführer in quantensicheren Kommunikations- und Quantenmesssystemen. Wir bieten Lösungen zum Schutz von Regierungen, Telekommunikationsinfrastrukturen sowie Banken und Finanzinstituten vor der Bedrohung "Ernten jetzt, später entschlüsseln" und liefern sowohl terrestrische als auch weltraumbasierte quantensichere Netzwerke, die weltweit im Live-Betrieb sind.
Unsere Quantenmesssysteme erweitern die Grenzen der Einzelphotonenmessung und ermöglichen Durchbrüche in der Quantenkommunikation, Sensorik, Computertechnik und ultrasensitiven Bildgebung in Partnerschaft mit führenden Forschern und Technologieinnovatoren weltweit.
Was Sie erwarten können
Das Platform Engineering-Team baut, sichert und betreibt skalierbare Infrastrukturen, die cloud-managed SaaS-Produkte mit vor Ort installierten Komponenten an Kundenstandorten unterstützen. Als Principal Site Reliability Engineer werden Sie die technische Führung für die Zuverlässigkeit unserer globalen Plattform übernehmen. Sie definieren die Strategie, Standards und das Betriebsmodell, um hochverfügbare, resiliente und sichere Dienste zu gewährleisten, während Sie aktiv an der Gestaltung und dem Betrieb der Technologien beteiligt sind, die unsere Produktionsumgebungen untermauern.
Sie arbeiten eng mit Architektur, DevSecOps, Cloud Operations und Produktentwicklung zusammen, um eine Kultur der Beobachtbarkeit, Automatisierung und kontinuierlichen Verbesserung zu fördern, wobei Sie sicherstellen, dass Probleme identifiziert und gelöst werden, bevor sie die Kunden beeinträchtigen.
- Definieren und leiten Sie die Zuverlässigkeitsstrategie für Tier 1 und Tier 2 Produktionsdienste, einschließlich Service-Level-Ziele, Fehlerbudgets, Beobachtbarkeit, Resilienz, Notfallwiederherstellung und Cloud-Sicherheit.
- Gestalten und betreiben Sie Beobachtungsplattformen, leiten Sie Chaos-Engineering- und Notfallwiederherstellungsinitiativen, verbessern Sie die Zuverlässigkeit von PostgreSQL, Redis/Valkey, Kafka und OpenSearch und liefern Sie AI Ops-Funktionen, einschließlich prädiktiver Überwachung, automatisierter Behebung und Selbstheilung.
- Leiten Sie die Reaktion auf schwerwiegende Vorfälle, den Bereitschaftsdienst und die globale Eskalation, während Sie Ingenieure betreuen und Ingenieurstandards etablieren, die in der gesamten Organisation übernommen werden.
Was Sie tun werden
Sie sind verantwortlich für die Zuverlässigkeit, Resilienz und betriebliche Exzellenz unserer Cloud-Plattform und Produktionsdienste und integrieren Zuverlässigkeitsprinzipien in architektonische Entscheidungen und Plattformdesigns. Sie etablieren Beobachtungsstandards, die Metriken, Protokolle, verteilte Nachverfolgung und Profiling abdecken, während Sie die Service-Level-Ziele und Fehlerbudgets über die Ingenieurteams hinweg steuern.
Sie leiten die Resilienztechnik durch Chaos-Tests, Notfallwiederherstellungsplanung und validierte Failover-Übungen, teilen sich die Verantwortung für die Cloud-Sicherheitslage mit DevSecOps und stellen die Zuverlässigkeit unserer kritischen Daten- und Streaming-Plattformen sicher. Sie optimieren die Plattformeffizienz durch Automatisierung, KI-gesteuerte Operationen und kontinuierliche betriebliche Verbesserung.
- Verantwortung für Produktionszuverlässigkeit, Beobachtbarkeit, Service-Level-Ziele, Fehlerbudgets, Resilienz, Backup und Notfallwiederherstellung, Cloud-Sicherheit und Plattformgovernance über alle kritischen Dienste hinweg.
- Leiten Sie das Incident Command, die Kommunikation mit der Geschäftsführung, Nachbesprechungen nach Vorfällen, den Bereitschaftsdienst und die globale Eskalation, während Sie prädiktive Überwachung, automatisierte Behebung und Selbstheilungsfähigkeiten bereitstellen.
- Arbeiten Sie mit Architektur, DevSecOps, Cloud Operations und Produktentwicklung zusammen, um Ingenieurstandards zu etablieren, Ingenieure zu betreuen und eine gemeinsame Zuverlässigkeits-Roadmap zu erstellen.
Was Sie mitbringen
Sie sind ein erfahrener Leiter im Bereich Site Reliability Engineering mit mehr als 15 Jahren Erfahrung in der Produktionsengineering und haben kürzlich praktische Verantwortung für großangelegte, fehlertolerante Produktionssysteme, die auf AWS oder GCP laufen. Sie haben erfolgreich Beobachtungsplattformen entworfen und betrieben, Programme für Service-Level-Ziele implementiert und messbare Verbesserungen in Verfügbarkeit, Zuverlässigkeit und mittlerer Wiederherstellungszeit erzielt.
Sie haben schwerwiegende Produktionsvorfälle geleitet, Resilienztests und Notfallwiederherstellungsübungen geplant und durchgeführt sowie die Ingenieurpraktiken über mehrere Teams hinweg durch technische Führung und Mentoring beeinflusst.
- 15+ Jahre Erfahrung im Produktionsengineering mit aktueller praktischer Verantwortung für großangelegte, fehlertolerante Produktionssysteme auf AWS oder GCP, einschließlich Verantwortung für Beobachtbarkeit, Service-Level-Ziele und Fehlerbudgets.
- Nachgewiesene Erfahrung in der Leitung von Resilienzinitiativen, validierten Notfallwiederherstellungen und Failover-Tests sowie im Umgang mit schwerwiegenden Produktionsvorfällen und messbaren Zuverlässigkeitsverbesserungen.
- Demonstrierte technische Führung durch Architekturüberprüfungen, Governance, Mentoring, Coaching und Ingenieurstandards, die in mehreren Teams und Diensten übernommen wurden.
Sie passen gut zu uns, wenn
Sie über umfassende Fachkenntnisse in Cloud-Infrastruktur, Plattformengineering und Cloud-Sicherheit verfügen, mit praktischer Erfahrung in der Sicherung verteilter Produktionsumgebungen durch Cloud-Sicherheitsmanagement, Erkennung von Laufzeitanfälligkeiten und automatisierte Durchsetzung von Richtlinien. Sie verstehen, wie man Zuverlässigkeit, Sicherheit, Netzwerk und betriebliche Effizienz im großen Maßstab ausbalanciert.
Sie haben Erfahrung in der Implementierung von KI-gesteuerten Betriebsfähigkeiten, wenden FinOps-Prinzipien an, um die Infrastruktur zu optimieren, und entwerfen hochverfügbare verteilte Systeme, die außergewöhnliche Resilienz und Leistung bieten.
- Nachgewiesene Erfahrung im Cloud-Sicherheitsmanagement, im Schutz von Arbeitslasten, in Policy-as-Code, in sicherheitsorientierter Infrastruktur und in automatisierter Sicherheitsdurchsetzung über cloud-native Plattformen und CI/CD-Pipelines.
- Praktische Erfahrung mit KI-Verkehrsmanagement durch LLM-Gateways, Kapazitätsplanung, Ressourcenoptimierung, FinOps-basierte Optimierung, autonome Operationen, prädiktive Alarmierung und selbstheilende Plattformen.
- Tiefes Wissen über Netzwerke, Routing, Lastenausgleich, Verbindungsresilienz und verteilte Systeme, mit der Fähigkeit, Netzwerk, Sicherheit und Zuverlässigkeit in skalierbare Plattformarchitekturen zu integrieren.
Was wir bieten
Eine Rolle bei einem der am schnellsten wachsenden und aufregendsten Quantenunternehmen der Welt. Ein wettbewerbsfähiges Vergütungssystem, ein Leistungspaket und einen Aktienplan, die darauf ausgelegt sind, Exzellenz zu belohnen. Flexible Arbeitsmodelle, die es Ihnen ermöglichen, Ihr Leben, Ihre Familie und Ihre Karriere in Einklang zu bringen. Laufende Schulungen und Weiterbildungen, um Ihre Fähigkeiten scharf zu halten und Ihr Wachstum auf Kurs zu halten. Einen Karriereentwicklungsplan innerhalb der Unternehmen der IonQ-Gruppe. Eine dynamische, enge Umgebung, in der Sie mit einem globalen Team von Experten zusammenarbeiten. Eine leistungsorientierte Kultur, die auf Vertrauen, Teamarbeit und gemeinsamen Ambitionen basiert.
ID Quantique/IonQ ist ein Arbeitgeber, der Chancengleichheit bietet und qualifizierte Bewerber ohne Rücksicht auf Rasse, Hautfarbe, Glauben, Religion, nationale Herkunft, Geschlecht, sexuelle Orientierung, Geschlechtsidentität, Alter, Behinderung, Veteranenstatus oder einen anderen gesetzlich geschützten Status berücksichtigt.
Principal Site Reliability Engineer Arbeitgeber: ID Quantique
ID Quantique ist ein hervorragender Arbeitgeber, der seinen Mitarbeitern in Genf eine flexible Arbeitsumgebung und die Möglichkeit zur Beteiligung am Unternehmen bietet. Unsere offene und innovative Unternehmenskultur fördert die Zusammenarbeit und das Wachstum, während wir an der Spitze der Quanten-Technologie stehen. Hier haben Sie die Chance, an bedeutenden Projekten zu arbeiten und Ihre Fähigkeiten in einem dynamischen Team weiterzuentwickeln.
StudySmarter Expertenrat🤫
Wir sind der Meinung, dass du so Principal Site Reliability Engineer erhalten könntest
✨Engagier dich in Entwickler-Communities!
Lass uns mal ehrlich sein: In der Software-Entwicklung sind Netzwerke Gold wert! Tummel dich in GitHub-Projekten, nehme an lokalen Meetups oder Hackathons teil und vernetze dich mit anderen Entwicklern. So steigerst du nicht nur deine Sichtbarkeit, sondern lernst auch die neuesten Trends und Technologien kennen.
✨Zeig deine Fähigkeiten!
Erstelle ein Portfolio, das deine besten Projekte und Code-Examples zeigt. Nichts überzeugt mehr als ein praktischer Beweis deiner Skills. Das kann auch helfen, bei ID Quantique anzuklopfen, wenn du dich auf die Stelle als Principal Site Reliability Engineer bewirbst – so wissen sie gleich, was sie von dir erwarten können!
✨Nutze Jobplattformen speziell für Tech-Jobs!
Plattformen wie Stack Overflow Jobs oder AngelsList sind perfekte Orte, um Vollzeitstellen in der Software-Entwicklung zu finden. Hier sind viele tolle Unternehmen auf der Suche nach Talenten wie uns, also schau regelmäßig vorbei und bewirb dich direkt über die Website.
✨Such dir Mentoren und Feedback!
Hol dir Feedback von erfahrenen Entwicklern, die dir Tipps geben können, was Recruiter wirklich suchen. Ob über LinkedIn oder persönliche Kontakte: Menschen, die sich in der Branche auskennen, können enorm wertvoll sein, um dir zu helfen, dich optimal auf deine Bewerbung bei ID Quantique vorzubereiten!
Wir glauben, dass du diese Fähigkeiten brauchst, um Principal Site Reliability Engineer mit Bravour zu bestehen
Einige Tipps für deine Bewerbung 🫡
Highlights deiner Coding-Skills:In der Software-Entwicklung kommt es auf konkrete Fähigkeiten an. Vergiss nicht, relevante Programmiersprachen und Frameworks in deinen Lebenslauf aufzunehmen. Zeig uns, was du kannst – vielleicht mit einem Link zu deinem GitHub-Profil oder einer Übersicht deiner Side Projects, die deine Programmierkenntnisse illustrieren.
Dokumentation deiner Erfolge:Gerade bei einer Vollzeitstelle in der Software-Entwicklung sind konkrete Ergebnisse Gold wert. Nenn uns Zahlen und Ergebnisse aus deinen vorherigen Projekten. Hast du den Code optimiert oder Systemfehler behoben? Solche Erfolge zeigen, dass du die Sprache der Entwickler sprichst und einen echten Mehrwert bringst.
Attraktive Projektbeschreibungen:Wenn du an Projekten gearbeitet hast, die hervorstechen, beschreibe sie ausführlich in deinem Lebenslauf. Was war das Problem, das du gelöst hast? Welche Technologien hast du eingesetzt? Das gibt uns einen klaren Einblick in deine Herangehensweise und Problemlösungsfähigkeiten.
Motivation zeigen:In deinem Anschreiben solltest du deine Motivation für die Stelle im Bereich Software-Entwicklung bei ID Quantique klar herausstellen. Warum sprichst gerade du die Anforderungen für diese Vollzeitrolle an? Mach deutlich, was dich an der Arbeit bei uns reizt und wie du über das rein Technische hinaus wachsen möchtest.
Wie man sich auf ein Vorstellungsgespräch bei ID Quantique vorbereitet
✨Technische Vorbereitung auf die Coding-Challenges
In der Software-Entwicklung sind technische Fragen oft ein zentraler Teil des Interviews. Macht euch mit Plattformen wie LeetCode oder HackerRank vertraut, um eure Problemlösungsfähigkeiten zu trainieren. Zeigt im Interview viel Selbstbewusstsein beim Erklären eurer Ansätze!
✨Das eigene Portfolio im besten Licht präsentieren
Stellt sicher, dass ihr ein aussagekräftiges Portfolio habt, das einige eurer besten Projekte zeigt. Seid bereit, darüber zu sprechen, was eure Rolle war, welche Technologien ihr verwendet habt und welche Herausforderungen es gab. Das gibt den Interviewern einen Einblick in eure praktische Erfahrung.
✨Teamfähigkeit und Kommunikation betonen
In einer Vollzeit-Position wird Kommunikation im Team sehr wichtig sein. Seid bereit, Beispiele aus der Vergangenheit zu teilen, in denen ihr effektiv im Team gearbeitet habt. Dies zeigt, dass ihr nicht nur technische Fähigkeiten habt, sondern auch gut ins Team passt.
✨Vorbereitung auf Fragen zur Software-Architektur
Bereitet euch darauf vor, Fragen zur Software-Architektur zu beantworten. Themen wie RESTful APIs, Microservices und Cloud-Architekturen können Teil eures Interviews sein. Zeigt euer Verständnis durch Diskussionen und Beispiele aus eurer bisherigen Arbeit oder Projekte.