Senior GPU Cloud SRE - Scale & Observability

Senior GPU Cloud SRE - Scale & Observability

Vollzeit Vor Ort
N

pNVIDIA Corporation is hiring a Senior Site Reliability Engineer to manage large-scale Kubernetes clusters, optimize GPU workloads, and uphold reliability across clouds. You will define SLOs/SLIs, lead incident response, and build tools to monitor latency, health and performance for researchers and enterprise clients. /ppIdeal candidates have 10+ years in production operations, strong Linux networking, cloud security, and hands-on experience with Terraform, Ansible, and observability stacks. /p #J-18808-Ljbffr

Senior GPU Cloud SRE - Scale & Observability Arbeitgeber: NVIDIA Corporation

NVIDIA ist ein herausragender Arbeitgeber, der nicht nur innovative Technologien im Bereich Grafik und KI vorantreibt, sondern auch eine unterstützende und vielfältige Arbeitsumgebung bietet. Als Teil des EMEA-Leadership-Teams haben Sie die Möglichkeit, in einem dynamischen Umfeld zu arbeiten, das auf persönliches Wachstum und Teamarbeit setzt. Mit wettbewerbsfähigen Gehältern und einem umfassenden Leistungspaket sorgt NVIDIA dafür, dass Sie und Ihre Familie bestens versorgt sind, während Sie an der Spitze der technologischen Entwicklung stehen.

N

Kontaktdaten:

NVIDIA Corporation Recruiting-Team