Site Reliability Engineer

Site Reliability Engineer

München Vollzeit 63000 - 77000 € / Jahr (geschätzt) Homeoffice (teilweise)
H

Auf einen Blick

  • Aufgaben: Entwickle und verwalte Kubernetes-Infrastrukturen in hochsicheren Umgebungen.
  • Unternehmen: Helsing, ein innovatives Unternehmen im Bereich Verteidigungs-KI mit einer offenen Kultur.
  • Vorteile: Wettbewerbsfähige Vergütung, Umzugshilfe und soziale sowie Bildungszulagen.
  • Weitere Informationen: Dynamisches Umfeld mit Möglichkeiten zur persönlichen und beruflichen Weiterentwicklung.
  • Warum dieser Job: Trage zur Sicherung demokratischer Werte bei und arbeite an spannenden technischen Herausforderungen.
  • Qualifikationen: Erfahrung in Kubernetes, Cloud-Technologien und Automatisierung mit Skriptsprachen.

Das prognostizierte Gehalt liegt zwischen 63000 - 77000 € pro Jahr.

Helsing ist ein Verteidigungs-AI-Unternehmen. Unsere Mission ist es, unsere Demokratien zu schützen. Wir streben technologische Führerschaft an, damit offene Gesellschaften souveräne Entscheidungen treffen und ihre ethischen Standards kontrollieren können. Als Demokratien glauben wir, dass wir eine besondere Verantwortung haben, über die Entwicklung und den Einsatz leistungsstarker Technologien wie AI nachzudenken. Wir nehmen diese Verantwortung ernst. Wir sind ein ehrgeiziges und engagiertes Team von Ingenieuren, AI-Spezialisten und kundenorientierten Programmmanagern. Wir suchen nach mission-driven Menschen, die sich unseren europäischen Teams anschließen und ihre Fähigkeiten einsetzen, um die komplexesten und wirkungsvollsten Probleme zu lösen.

Die Rolle

Ein Großteil unserer Arbeit findet in hochsicheren On-Premise-Umgebungen statt, und wir suchen einen Site Reliability Engineer, der unsere hochsicheren Umgebungen unterstützt. Ihre Rolle als Site Reliability Engineer wird es sein, unsere On-Premise-Kubernetes-Infrastruktur zu entwerfen, zu implementieren und zu verwalten.

Wir suchen Ingenieure mit einer starken Arbeitsmoral und Priorisierungsfähigkeiten. Wir schätzen Teamplayer, die klar kommunizieren, Wissen großzügig teilen und effektiv zusammenarbeiten, um ihr Team – und unsere Mission – voranzubringen.

Der Alltag

  • Als SRE werden Sie cloud-native Infrastrukturplattformen vor Ort entwerfen und aufbauen, wobei der Schwerpunkt auf Kubernetes-basierten Lösungen liegt, die es unseren Entwicklungsteams ermöglichen, Dienste in großem Maßstab zu betreiben.
  • Sie werden robuste Observability-Frameworks mit Grafana, Prometheus und verteiltem Tracing erstellen, um die Systemzuverlässigkeit und -leistung sicherzustellen.
  • Sie werden sichere, multi-tenant Kubernetes-Cluster mit starken Zugriffskontrollen, Governance durch Policy-as-Code und Zero-Trust-Netzwerke zwischen roten und schwarzen Netzwerkdomänen entwerfen und implementieren.
  • Sie werden Operatoren und Controller entwickeln, um die Bereitstellung und Compliance der Infrastruktur zu automatisieren.
  • Sie werden MLOps-Plattformen aufbauen und pflegen, die es AI-Forschern ermöglichen, Machine-Learning-Modelle in der Produktion bereitzustellen, zu überwachen und zu skalieren.
  • Sie werden eng mit unseren Sicherheitsteams zusammenarbeiten, um die Sicherheit der Lieferkette, Container-Scanning und Laufzeitschutz über unseren cloud-nativen Stack hinweg zu implementieren.

Schlüsselqualifikationen

  • Scripting: Erfahrung in Python, Go, Rust oder Bash/Shell für Automatisierung und Tools.
  • Erfahrung mit GitOps-Workflows und CI/CD-Automatisierung.
  • Kubernetes-Expertise: tiefgehende Erfahrung im Betrieb von Produktions-Kubernetes-Clustern, Schreiben von benutzerdefinierten Controllern/Operatoren und Implementierung von Service-Mesh-Architekturen (Istio/Linkerd).
  • Cloud-native Technologien: praktische Erfahrung mit dem CNCF-Ökosystem, einschließlich Helm, ArgoCD, Flux und Container-Laufzeitsicherheitstools wie Falco.
  • Observability-Stack: Expertenwissen in Grafana, Prometheus, Loki, Tempo und OpenTelemetry. Erfahrung im Aufbau benutzerdefinierter Dashboards, Alarme und SLI/SLO-Frameworks.
  • Netzwerk: Expertenverständnis von Netzwerk-Konzepten, Protokollen und Sicherheit.
  • MLOps-Plattformen: Erfahrung mit Kubeflow, MLflow oder ähnlichen Plattformen.
  • Infrastructure as Code: Kenntnisse in Terraform, Ansible und Kubernetes-Manifestvorlagen. Erfahrung mit Policy-as-Code-Tools wie OPA/Gatekeeper.
  • Systemadministration: tiefes Verständnis der Linux/Unix-Systemadministration und hochverfügbarer, verteilter Systeme.
  • Komfortabel beim Aufbau von Daten- und Telemetrie-Pipelines zur Fehlersuche und Zukunftssicherung von Lösungen.

Sie sollten sich bewerben, wenn Sie:

  • Ein hohes Maß an persönlicher Integrität, Zuverlässigkeit und Aufmerksamkeit für Details haben.
  • Eine Software-Ingenieurmentalität mit einer Leidenschaft für den Aufbau von Plattformen und Tools haben, die die Produktivität der Entwickler multiplizieren.
  • Erfahrung im Betrieb cloud-nativer Workloads in On-Premise- oder luftdicht abgeschotteten Umgebungen haben.
  • Bereit sind, in München, Berlin, London oder Paris zu arbeiten und in einer hybriden Umgebung zu arbeiten.

Helsing ist ein Arbeitgeber, der Chancengleichheit bietet. Wir setzen uns für Chancengleichheit bei der Beschäftigung unabhängig von Rasse, Religion, sexueller Orientierung, Alter, Familienstand, Behinderung oder Geschlechtsidentität ein.

Site Reliability Engineer Arbeitgeber: Helsing

Helsing ist ein hervorragender Arbeitgeber, der eine offene und transparente Unternehmenskultur fördert, in der gesunde Debatten über den Einsatz von Technologie im Verteidigungsbereich willkommen sind. Als Senior Programme Manager - Maritime haben Sie die Möglichkeit, an bedeutenden Projekten zu arbeiten, die die Zukunft der maritimen Verteidigung gestalten, während Sie von einem engagierten Team unterstützt werden, das Wert auf persönliche und berufliche Weiterentwicklung legt. Mit wettbewerbsfähigen Gehältern, umfangreichen Sozialleistungen und einem starken Fokus auf Work-Life-Balance bietet Helsing ein Umfeld, in dem Mitarbeiter ihre Fähigkeiten sinnvoll einsetzen können, um einen positiven Einfluss auf die Gesellschaft auszuüben.

H

Kontaktdaten:

Helsing Recruiting-Team

Wir glauben, dass du diese Fähigkeiten brauchst, um Site Reliability Engineer mit Bravour zu bestehen

Scripting in Python, Go, Rust oder Bash/Shell
GitOps Workflows
CI/CD Automation
Kubernetes Expertise
Cloud-Native Technologien
Grafana
Prometheus