Site Reliability Engineer - eFX/ Crypto

Site Reliability Engineer - eFX/ Crypto

Vollzeit 63000 - 77000 € / Jahr (geschätzt) Homeoffice (teilweise)
S

Auf einen Blick

  • Aufgaben: Sichere die Zuverlässigkeit und Leistung unserer eFX/Crypto-Plattformen mit Kubernetes und Automatisierung.
  • Unternehmen: Swissquote, die führende digitale Bank in der Schweiz mit innovativer Kultur.
  • Vorteile: Flexibles Arbeiten, tolle Teamatmosphäre und Raum für persönliches Wachstum.
  • Weitere Informationen: Dynamisches Umfeld mit vielen Möglichkeiten zur beruflichen Weiterentwicklung.
  • Warum dieser Job: Gestalte die Zukunft des Finanzwesens und arbeite an spannenden Projekten.
  • Qualifikationen: Mindestens 3 Jahre Erfahrung in SRE oder DevOps und starke Kubernetes-Kenntnisse.

Das prognostizierte Gehalt liegt zwischen 63000 - 77000 € pro Jahr.

Wir suchen einen praktischen Site Reliability Engineer (SRE), der die Zuverlässigkeit, Verfügbarkeit, Skalierbarkeit und Leistung unserer Produktionsplattformen für eFX/Crypto sicherstellt. Die Rolle hat einen starken Fokus auf Kubernetes, Produktionsbetrieb, Automatisierung, Beobachtbarkeit und Infrastrukturzuverlässigkeit. Sie werden eng mit Infrastruktur- und Entwicklungsteams zusammenarbeiten, um unsere Produktionsumgebung in On-Premise- und Private-Cloud-Infrastrukturen zu betreiben und kontinuierlich zu verbessern.

Hauptverantwortlichkeiten:

  • Überwachung von Produktionssystemen, Reaktion auf Vorfälle und Sicherstellung einer optimalen Betriebszeit und Leistung von Anwendungen und Infrastruktur.
  • Betrieb, Wartung und Fehlersuche von Kubernetes-Clustern und containerisierten Anwendungen in der Produktion sowie in der On-Premise-Infrastruktur.
  • Beitrag zum Design und zur Implementierung skalierbarer und zuverlässiger Infrastruktur Lösungen.
  • Automatisierung von IT- und Betriebsprozessen zur Reduzierung manueller Arbeiten und Verbesserung der Effizienz.
  • Implementierung und Wartung von CI/CD-Pipelines und Bereitstellungsautomatisierung.
  • Überwachung und Verbesserung der Systembeobachtbarkeit mit Tools wie Prometheus, Grafana und Elastic/Kibana.
  • Analyse von Fehlern, Durchführung von Ursachenanalysen und Implementierung von Korrektur- und Präventivmaßnahmen.
  • Durchführung von Stress-, Resilienz-, Notfallwiederherstellungs- und BCP-Tests zur Validierung der Plattformstabilität.
  • Enge Zusammenarbeit mit Infrastruktur- und Entwicklungsteams zur Verbesserung der Produktionsbereitschaft und Systemzuverlässigkeit.
  • Teilnahme an der Rufbereitschaft und Bereitstellung operativer Unterstützung für Produktionssysteme.
  • Kontinuierliche Verbesserung von Betriebsprozessen, Automatisierung, Überwachung und Zuverlässigkeitspraktiken.

Qualifikationen:

  • 3+ Jahre Erfahrung in SRE, DevOps, Systemengineering, Plattformengineering oder einer ähnlichen Produktionsingenieurrolle.
  • Starke praktische Erfahrung mit Kubernetes in Produktionsumgebungen – zwingend erforderlich.
  • Solides Verständnis der Kubernetes-Architektur und des täglichen Betriebs, einschließlich: Service-Mesh und Istio, Benutzerverwaltung, Gesundheitsprüfungen und Proben, Kubernetes-Netzwerk und DNS, Fehlersuche und Leistungsprobleme, Linux-Administration und Fehlersuche.
  • Erfahrung mit Docker und Containertechnologien.
  • Praktische Erfahrung mit On-Premise-Infrastruktur und/oder Private-Cloud-Umgebungen.
  • Erfahrung mit Infrastructure as Code und Automatisierungstools wie Terraform und Ansible.
  • Erfahrung mit CI/CD-Pipelines.
  • Erfahrung mit Beobachtungs- und Überwachungstools wie Prometheus, Grafana, Elastic/Kibana.
  • Gute Programmier- und Skriptfähigkeiten in Python und Shell.
  • Starkes Verständnis der Netzwerkgrundlagen, einschließlich TCP/IP, DNS, HTTPS, HTTP und Lastenausgleich.
  • Gutes Verständnis der SRE-Prinzipien, einschließlich SLIs, SLOs, SLAs, Verfügbarkeit, Zuverlässigkeit und Dienstleistung Leistung.
  • Gutes Verständnis von Java-Webanwendungen und Webservern wie Spring Boot und Apache Tomcat.
  • Fließendes Englisch, sowohl schriftlich als auch mündlich, mit der Bereitschaft, Französisch zu lernen.

Nice to Have:

  • CKA- oder CKAD-Zertifizierung.
  • Erfahrung mit Helm, ArgoCD, Github Actions oder Kubernetes-Operatoren.
  • Kenntnisse in Apache Kafka oder RabbitMQ.
  • Kenntnisse in MT4/MT5.
  • Erfahrung mit Windows Server 2016/2022.
  • Erfahrung im Bereich eFX, Handel, Kryptowährung, Banking oder anderen Finanzdienstleistungen.
  • Erfahrung mit hochverfügbaren oder latenzarmen Produktionssystemen.

Wer Sie sind:

  • Ein Teamplayer, der gerne Kollegen hilft und Lücken zwischen Abteilungen schließt.
  • Detailorientiert und sorgfältig in Ihrer Arbeit.
  • Leidenschaft für Technologie und bestrebt, über AI-Innovationen auf dem Laufenden zu bleiben.

Bitte beachten Sie, dass Swissquote niemals sensible persönliche Informationen oder Zahlungen während des Rekrutierungsprozesses anfordert. Eine solche Anfrage ist betrügerisch.

Site Reliability Engineer - eFX/ Crypto Arbeitgeber: Swissquote

Swissquote ist ein hervorragender Arbeitgeber, der seinen Mitarbeitern die Möglichkeit bietet, in einem dynamischen und innovativen Umfeld zu arbeiten. Mit einer offenen Unternehmenskultur, die Kreativität und Eigenverantwortung fördert, sowie zahlreichen Wachstums- und Entwicklungsmöglichkeiten, ist es der ideale Ort für Fachkräfte, die ihre Fähigkeiten im Bereich Cloud Operations und Site Reliability Engineering weiterentwickeln möchten. Zudem profitieren die Mitarbeiter von flexiblen Arbeitsbedingungen und einer wertschätzenden Atmosphäre, die Erfolge, egal ob groß oder klein, feiert.

S

Kontaktdaten:

Swissquote Recruiting-Team

Wir glauben, dass du diese Fähigkeiten brauchst, um Site Reliability Engineer - eFX/ Crypto mit Bravour zu bestehen

Kubernetes
Containerization
Automatisierung
CI/CD-Pipelines
Überwachungs- und Observabilitätswerkzeuge (Prometheus, Grafana, Elastic/Kibana)
Fehleranalyse und Root-Cause-Analyse
Linux-Administration