Senior HPC AI Cluster Engineer

Senior HPC AI Cluster Engineer

Vollzeit 63000 - 77000 € / Jahr (geschätzt) Kein Homeoffice möglich
NVIDIA AI

Auf einen Blick

  • Aufgaben: Entwickle und verwalte große HPC/AI-Cluster mit modernster Technologie.
  • Unternehmen: NVIDIA, ein führendes Unternehmen im Bereich KI und Hochleistungsrechnen.
  • Vorteile: Attraktives Gehalt, Gesundheitsleistungen und Möglichkeiten zur beruflichen Weiterentwicklung.
  • Weitere Informationen: Dynamisches Team mit großartigen Wachstumschancen in einem innovativen Umfeld.
  • Warum dieser Job: Sei Teil von bahnbrechenden Projekten in der KI und revolutioniere die Computertechnologie.
  • Qualifikationen: Erfahrung in HPC, Linux und Softwareentwicklung erforderlich.

Das prognostizierte Gehalt liegt zwischen 63000 - 77000 € pro Jahr.

NVIDIA sucht einen erfahrenen HPC-AI Ingenieur, der dem Team für Netzwerk-Cluster-Lösungen beitritt. Wir konzentrieren uns auf den Aufbau von Supercomputern und KI-Clustern basierend auf bahnbrechenden Technologien. Wir suchen einen herausragenden Ingenieur, der eine Schlüsselrolle bei der Entwicklung der aufregendsten Computerhardware und -software spielt, um zu den neuesten Durchbrüchen in der künstlichen Intelligenz und GPU-Computing beizutragen.

Sie werden Einblicke in das Design von Systemen im großen Maßstab und Tuning-Mechanismen für großangelegte Berechnungen geben. Sie arbeiten mit den neuesten beschleunigten Computing- und Deep Learning-Software- und Hardware-Plattformen sowie mit vielen wissenschaftlichen Forschern, Entwicklern und Kunden zusammen, um verbesserte Workflows zu gestalten und neue, führende differenzierte Lösungen zu entwickeln. Sie werden mit HPC-, OS-, GPU-Compute- und Systemspezialisten interagieren, um große Leistungsplattformen zu entwerfen, zu entwickeln und in Betrieb zu nehmen.

Was Sie tun werden:

  • Entwurf, Implementierung und Wartung von großangelegten HPC/AI-Clustern mit Überwachung, Protokollierung und Alarmierung
  • Verwaltung von Linux-Job-/Arbeitslastplänen und Orchestrierungstools
  • Entwicklung und Pflege von kontinuierlichen Integrations- und Bereitstellungspipelines
  • Entwicklung von Werkzeugen zur Automatisierung der Bereitstellung und Verwaltung von großangelegten Infrastrukturumgebungen, zur Automatisierung der operativen Überwachung und Alarmierung sowie zur Ermöglichung des Self-Service-Konsums von Ressourcen
  • Bereitstellung von Überwachungslösungen für Server, Netzwerk und Speicher
  • Durchführung von Fehlersuche von unten nach oben, beginnend mit der Hardware, dem Betriebssystem, dem Software-Stack und der Anwendungsebene
  • Als technischer Ansprechpartner Standardmethoden entwickeln, neu definieren und dokumentieren, um sie mit internen Teams zu teilen
  • Unterstützung der Forschung

Senior HPC AI Cluster Engineer Arbeitgeber: NVIDIA AI

NVIDIA ist ein herausragender Arbeitgeber, der eine dynamische und unterstützende Arbeitsumgebung bietet, in der Innovation und Teamarbeit im Mittelpunkt stehen. Als Teil des EMEA-Teams für End User Support Engineering haben Sie die Möglichkeit, an der Spitze der Technologie zu arbeiten und Ihre Karriere durch kontinuierliche Weiterbildung und Mentoring voranzutreiben. Die Unternehmenskultur fördert Vielfalt und Kreativität, während die strategische Lage in EMEA Ihnen Zugang zu einem breiten Netzwerk von Fachleuten und Ressourcen bietet, um einen nachhaltigen Einfluss auf die digitale Interaktion der Mitarbeiter zu erzielen.

NVIDIA AI

Kontaktdaten:

NVIDIA AI Recruiting-Team

Wir glauben, dass du diese Fähigkeiten brauchst, um Senior HPC AI Cluster Engineer mit Bravour zu bestehen

HPC-Architektur
AI-Cluster-Engineering
Linux-Management
Job-/Workload-Orchestrierung
Continuous Integration
Continuous Delivery
Automatisierung von Infrastruktur