Senior HPC AI Cluster Engineer

Senior HPC AI Cluster Engineer

Vollzeit 63000 - 77000 € / Jahr (geschätzt) Homeoffice (teilweise)
CH01 NVIDIA Switzerland AG

Auf einen Blick

  • Aufgaben: Entwickle und verwalte große HPC/AI-Cluster mit modernster Technologie.
  • Unternehmen: NVIDIA, ein führendes Unternehmen im Bereich KI und Hochleistungsrechnen.
  • Vorteile: Attraktives Gehalt, flexible Arbeitszeiten und Möglichkeiten zur beruflichen Weiterentwicklung.
  • Weitere Informationen: Dynamisches Team mit vielen Möglichkeiten zur Zusammenarbeit und Innovation.
  • Warum dieser Job: Sei Teil von bahnbrechenden Technologien und gestalte die Zukunft der KI mit.
  • Qualifikationen: Erfahrung in HPC, Linux und Systemarchitektur erforderlich.

Das prognostizierte Gehalt liegt zwischen 63000 - 77000 € pro Jahr.

NVIDIA sucht einen erfahrenen HPC-AI Ingenieur, der dem Team für Netzwerkcluster-Lösungen beitritt. Wir konzentrieren uns auf den Aufbau von Supercomputern und KI-Clustern basierend auf bahnbrechenden Technologien. Wir suchen einen herausragenden Ingenieur, der eine Schlüsselrolle bei der Entwicklung der aufregendsten Computerhardware und -software spielt, um zu den neuesten Durchbrüchen in der künstlichen Intelligenz und GPU-Computing beizutragen.

Sie werden Einblicke in das Design von Systemen im großen Maßstab und Tuning-Mechanismen für großangelegte Berechnungen geben. Sie arbeiten mit den neuesten beschleunigten Computing- und Deep Learning-Software- und Hardware-Plattformen sowie mit vielen wissenschaftlichen Forschern, Entwicklern und Kunden zusammen, um verbesserte Workflows zu gestalten und neue, führende differenzierte Lösungen zu entwickeln. Sie interagieren mit HPC-, OS-, GPU-Compute- und Systemspezialisten, um große Leistungsplattformen zu entwerfen, zu entwickeln und in Betrieb zu nehmen.

Was Sie tun werden:

  • Entwurf, Implementierung und Wartung von großangelegten HPC/AI-Clustern mit Überwachung, Protokollierung und Alarmierung
  • Verwaltung von Linux-Job-/Arbeitslastplänen und Orchestrierungstools
  • Entwicklung und Wartung von kontinuierlichen Integrations- und Bereitstellungspipelines
  • Entwicklung von Werkzeugen zur Automatisierung der Bereitstellung und Verwaltung von großangelegten Infrastrukturumgebungen, zur Automatisierung der operativen Überwachung und Alarmierung sowie zur Ermöglichung des Self-Service-Konsums von Ressourcen
  • Bereitstellung von Überwachungslösungen für Server, Netzwerk und Speicher
  • Durchführung von Fehlersuche von unten nach oben, vom Bare Metal über das Betriebssystem, den Software-Stack bis hin zur Anwendungsebene
  • Als technische Ressource Standardmethoden entwickeln, neu definieren und dokumentieren, um sie mit internen Teams zu teilen
  • Unterstützung der Forschung

Senior HPC AI Cluster Engineer Arbeitgeber: CH01 NVIDIA Switzerland AG

NVIDIA ist ein hervorragender Arbeitgeber, der seinen Mitarbeitern die Möglichkeit bietet, an der Spitze der Technologie zu arbeiten und bedeutende Beiträge im Bereich der künstlichen Intelligenz und des GPU-Computings zu leisten. Mit einem dynamischen Arbeitsumfeld, das Innovation und Zusammenarbeit fördert, profitieren Mitarbeiter von umfangreichen Wachstumschancen und der Möglichkeit, mit führenden Wissenschaftlern und Entwicklern zusammenzuarbeiten. Die Lage in einem technologisch fortschrittlichen Umfeld ermöglicht es den Mitarbeitern, Zugang zu den neuesten Entwicklungen und Ressourcen zu haben, was die Arbeit nicht nur herausfordernd, sondern auch äußerst lohnend macht.

CH01 NVIDIA Switzerland AG

Kontaktdaten:

CH01 NVIDIA Switzerland AG Recruiting-Team

Wir glauben, dass du diese Fähigkeiten brauchst, um Senior HPC AI Cluster Engineer mit Bravour zu bestehen

HPC-Architektur
AI-Cluster-Engineering
Linux-Management
Job-/Workload-Orchestrierung
Continuous Integration
Continuous Delivery
Automatisierung von Infrastruktur