Auf einen Blick
- Aufgaben: Verwalte Kubernetes und entwickle Automatisierungsskripte für stabile Plattformoperationen.
- Unternehmen: HCLTech, ein schnell wachsendes Tech-Unternehmen mit globaler Präsenz.
- Vorteile: Wettbewerbsfähiges Gehalt, flexible Arbeitszeiten und Weiterbildungsmöglichkeiten.
- Weitere Informationen: 24x7 Bereitschaft und spannende Karrierechancen in einem vielfältigen Team.
- Warum dieser Job: Arbeite an innovativen Projekten und verbessere die Systemstabilität in einem dynamischen Umfeld.
- Qualifikationen: Erfahrung mit Linux, Kubernetes und Programmiersprachen wie Python oder Go.
Das prognostizierte Gehalt liegt zwischen 63000 - 77000 € pro Jahr.
Wir suchen einen Site Reliability Engineer (SRE) mit einem starken Hintergrund in Observability, sicherem Logging und Automatisierung. Der ideale Kandidat hat praktische Erfahrung mit Elasticsearch und/oder Prometheus-Plattformen. Diese Rolle umfasst kritische Verantwortlichkeiten im Plattformbetrieb, einschließlich Incident Management, Durchführung geplanter Wartungsarbeiten und Mitwirkung an Ingenieuraufgaben zur Verbesserung der Systemstabilität. Der SRE ist auch verantwortlich für die Einhaltung von Standardarbeitsanweisungen (SOPs) und trägt aktiv zu deren kontinuierlicher Verbesserung bei, indem er konstruktives Feedback gibt.
Hauptverantwortlichkeiten:
- Plattform Engineering & DevOps: Verwaltung von Kubernetes und Container-Orchestrierung, einschließlich Helm-Chart-Konfigurationen und CI/CD-Pipelines (Jenkins, ArgoCD). Entwicklung von Automatisierungsskripten (Python, Bash, Go) und Bereitstellung von Infrastructure-as-Code (IaC) Lösungen.
- Observability, Monitoring & Visualisierung: Pflege von Prometheus-Lösungen (Scrape-Konfigurationen, Alarmregeln, PromQL-Abfragen), Verwaltung von Thanos und Grafana.
- Elastic Stack Operationen & Log-Management: Konfiguration und Optimierung von Elasticsearch-Clustern, Logstash-Pipelines und Kibana-Dashboards für sicheres, skalierbares Log-Processing.
- Incident Response, Troubleshooting & Zusammenarbeit: Teilnahme an 24x7 Bereitschaftsdiensten für schnelle Incident-Reaktionen, Fehlersuche bei Plattform-, Daten- und Leistungsproblemen sowie Mitwirkung am Major Incident Management (MIM).
- Sichere Operationen & Compliance: Sicherstellen, dass die Systemoperationen den Sicherheits- und Datenschutzanforderungen entsprechen, Pflege sicherer Dokumentationen und Verwaltung von Zugriffsrichtlinien.
Qualifikationen, Anforderungen und Fähigkeiten:
- Starkes Verständnis von Linux-Konzepten, vorzugsweise in Kubernetes-Umgebungen.
- Solides Verständnis der Netzwerkgrundlagen und REST-APIs.
- Kenntnisse in Python, Go oder Bash.
- Kenntnisse in Git-basierten Konfigurationsmanagement-Workflows.
- Vertrautheit mit CI/CD-Tools wie Helm, Jenkins oder ArgoCD.
- Erfahrung mit Elasticsearch und/oder OpenSearch.
- Bereitschaft zur Schichtarbeit im 24x7 Bereitschaftsdienst, einschließlich Wochenenden und Feiertagen.
- Besitz einer Ü2-Sicherheitsfreigabe.
Bevorzugte Zertifizierungen: Elastic Certified Engineer, LPIC Level 2, Kubernetes Administrator.
Wichtige Anforderung: Diese Position erfordert die Eignung für und den erfolgreichen Abschluss einer deutschen Ü2-Sicherheitsüberprüfung. Bitte stellen Sie sicher, dass Sie bereit und in der Lage sind, den erforderlichen Hintergrundprüfungsprozess als Bedingung für die Beschäftigung abzuschließen.
Wir fördern Chancengleichheit für alle Mitarbeiter, unabhängig von ihrem kulturellen und sozialen Hintergrund, Geschlecht, Behinderung, Alter, Religion, Überzeugungen und sexueller Identität. Wir geben schwerbehinderten Bewerbern und solchen mit gleichwertigem Status bei gleicher Eignung Vorrang.
Site Reliability Engineer Arbeitgeber: HCLTech Germany
HCLTech ist ein dynamisches und wachsendes Unternehmen, das seinen Mitarbeitern eine inspirierende Arbeitsumgebung bietet, in der Vielfalt, Kreativität und Leidenschaft geschätzt werden. Als MFA SRE Engineer haben Sie die Möglichkeit, an innovativen Projekten zu arbeiten und Ihre Fähigkeiten in einem internationalen Team weiterzuentwickeln, während Sie gleichzeitig von umfangreichen Schulungs- und Entwicklungsmöglichkeiten profitieren. Unsere Unternehmenskultur fördert Zusammenarbeit und kontinuierliche Verbesserung, was HCLTech zu einem hervorragenden Arbeitgeber macht.