Senior HPC and AI Network Software Architect

Senior HPC and AI Network Software Architect

Vollzeit 117000 - 143000 € / Jahr (geschätzt) Homeoffice (teilweise)
NVIDIA Switzerland AG

Auf einen Blick

  • Aufgaben: Entwickle skalierbare Softwarearchitekturen für KI-Training und -Inference.
  • Unternehmen: NVIDIA, ein führendes Unternehmen in Grafik- und KI-Technologie.
  • Vorteile: Attraktives Gehalt, umfassende Sozialleistungen und ein kreatives Arbeitsumfeld.
  • Weitere Informationen: Dynamisches Team mit Fokus auf kontinuierliches Lernen und Innovation.
  • Warum dieser Job: Gestalte die Zukunft der KI-Infrastruktur und arbeite an bahnbrechenden Projekten.
  • Qualifikationen: Ph.D. oder gleichwertige Erfahrung in Informatik und 5+ Jahre relevante Berufserfahrung.

Das prognostizierte Gehalt liegt zwischen 117000 - 143000 € pro Jahr.

NVIDIA hat die Computergraphik, PC-Gaming und beschleunigtes Rechnen seit mehr als 25 Jahren transformiert. Es ist ein einzigartiges Erbe der Innovation, das durch großartige Technologie und erstaunliche Menschen angetrieben wird. Heute nutzen wir das unbegrenzte Potenzial von KI, um die nächste Ära des Rechnens zu definieren. Eine Ära, in der unsere GPU als das Gehirn von Computern, Robotern und selbstfahrenden Autos fungiert, die die Welt verstehen können. Das, was noch nie zuvor getan wurde, erfordert Vision, Innovation und die besten Talente der Welt. Als NVIDIAN werden Sie in einer vielfältigen, unterstützenden Umgebung arbeiten, in der jeder inspiriert ist, sein Bestes zu geben. Kommen Sie ins Team und sehen Sie, wie Sie einen bleibenden Einfluss auf die Welt ausüben können.

Wir suchen einen Senior HPC und AI Network Software Architect, um die nächste Generation skalierbarer KI-Infrastruktur aufzubauen. Die Rolle betont verteiltes Training, Echtzeitinferenz und Kommunikationseffizienz über große Systeme hinweg. Sie werden neue Software- und Hardwareansätze entwickeln, die Plattformentwicklung durch praktische Innovationen gestalten und zur Gestaltung von Systemen beitragen, die die schnellsten KI-Workloads weltweit antreiben. Arbeiten Sie mit unserem angesehenen Team von Forschern und Ingenieuren zusammen, die Software und Hardware für KI in herausragendem Maßstab entwickeln.

Was Sie tun werden:

  • Entwickeln und weiterentwickeln der Architektur skalierbarer Softwaresysteme für verteiltes KI-Training und -Inference, mit Fokus auf Durchsatz, Latenz, Resilienz und Speichereffizienz über Cluster-Scale-Deployments.
  • Entwickeln und bewerten von Next-Generation-Kommunikations- und Laufzeitfähigkeiten in Bibliotheken wie NCCL, UCX und UCC, die auf die sich entwickelnden Anforderungen von KI-Workloads zugeschnitten sind.
  • Partnerschaft mit KI-Framework-Teams (z.B. TensorFlow, PyTorch, JAX) und internen Plattformteams, um Integrationen zu erstellen, neue Ansätze zu erkunden und die End-to-End-Leistung und Zuverlässigkeit zu verbessern.
  • Zusammenarbeit an Hardware- und systemlevel Funktionen über GPUs, DPUs und Interconnects, um die Datenbewegung zu beschleunigen und neue Fähigkeiten für Training, Inferenz und Modellbereitstellung im großen Maßstab zu ermöglichen.
  • Innovation vorantreiben in Laufzeitsystemen, Kommunikationsbibliotheken und KI-spezifischen Protokollschichten, um neue Ideen in praktische Fähigkeiten und robuste Implementierungen umzusetzen.

Was wir sehen möchten:

  • Ph.D. oder gleichwertige Berufserfahrung in Informatik, Computertechnik oder einem eng verwandten Bereich.
  • 5+ Jahre Erfahrung in der Systemprogrammierung, paralleler oder verteilter Verarbeitung, Hochleistungsnetzwerken oder großflächiger Datenbewegung, einschließlich Erfahrung im Entwerfen und Bauen komplexer Systeme.
  • Starker Programmierhintergrund in C++, Python und idealerweise CUDA oder anderen GPU-Programmiermodellen, mit nachweislicher Erfahrung im Aufbau von produktionsrelevanter, leistungsstarker Software.
  • Umfassende praktische Erfahrung mit KI-Frameworks (z.B. PyTorch, TensorFlow, JAX) und ein solides Verständnis dafür, wie Kommunikationsbibliotheken und Laufzeitsysteme großflächiges Training und Inferenz ermöglichen.
  • Nachgewiesener Erfolg bei der Entwicklung und Verfeinerung von Hochdurchsatz-, Niedriglatenzsystemen, einschließlich der Fähigkeit, über Software-Stacks, Hardwarefähigkeiten und Systemengpässe hinweg zu denken.
  • Starke Zusammenarbeit in einem multinationalen, interdisziplinären Umfeld, mit der Fähigkeit, Ideen beizutragen, Schwung aufzubauen und effektiv mit leitenden Ingenieuren, Forschern und Partnerteams zu arbeiten.

Wege, um sich von der Masse abzuheben:

  • Tiefe Expertise mit NCCL, UCX, UCC oder ähnlichen Kommunikationsbibliotheken, die in großflächigen KI- und HPC-Workloads verwendet werden.
  • Starker Hintergrund in Netzwerken und Kommunikationsprotokollen, RDMA, kollektiven Kommunikationen, congestion-aware Transport oder accelerator-aware Networking.
  • Umfassendes Wissen über das Training und die Bereitstellung großer Modelle im großen Maßstab, einschließlich Kommunikationsengpässen, Planungsherausforderungen und systemlevel Trade-offs zwischen Rechenleistung, Speicher und Fabric.
  • Erfahrung in der Gestaltung von Hardware-Software-Co-Design für verteilte KI-Systeme, einschließlich Beiträgen, die GPU-, DPU-, Interconnect- oder Laufzeitfähigkeiten vorangetrieben haben.
  • Vertrautheit mit der Infrastruktur für die Bereitstellung von LLMs oder transformerbasierten Modellen, einschließlich Sharding, Pipelining, Expertenparallelismus oder hybriden Parallelismus.

Bei NVIDIA arbeiten Sie mit Personen zusammen, die sich dem kontinuierlichen Lernen und kreativen Problemlösen in der Branche widmen und die Grenzen dessen, was in KI und Hochleistungsrechnen möglich ist, erweitern. Wenn Sie leidenschaftlich daran interessiert sind, verteilte Systeme zu entwerfen, die KI-Infrastruktur voranzutreiben und Probleme im großen Maßstab zu lösen, möchten wir von Ihnen hören!

Allgemein als einer der begehrtesten Arbeitgeber der Technologiebranche angesehen, bietet NVIDIA hoch wettbewerbsfähige Gehälter und ein umfassendes Leistungspaket. Planen Sie Ihre Zukunft und sehen Sie, was wir Ihnen und Ihrer Familie anbieten können.

  • Arbeitsort: 8004 Zürich (ZH)
  • Zusätzliche Informationen zum Arbeitsplatz: Europaallee 39, 8004 Zürich, Schweiz
  • Arbeitsbelastung: 100%
  • Stellenantritt: Sofort
  • Beschäftigungsdauer: Unbefristet
  • Qualifikation: qualifiziert
  • Berufserfahrung: Mehr als 3 Jahre
  • Ausbildung: Doktorat von einer Universität oder gleichwertig
  • Englisch: Mündlich: Gute Kenntnisse, Schriftlich: Gute Kenntnisse
  • Bewerbung: Online-Formular

Senior HPC and AI Network Software Architect Arbeitgeber: NVIDIA Switzerland AG

NVIDIA in Zürich bietet eine inspirierende Arbeitsumgebung, die von Innovation und Zusammenarbeit geprägt ist. Als Arbeitgeber fördern wir das Wachstum unserer Mitarbeiter durch kontinuierliche Weiterbildung und die Möglichkeit, an bahnbrechenden Projekten im Bereich künstliche Intelligenz zu arbeiten. Unsere offene Unternehmenskultur und die Lage in einer der dynamischsten Städte Europas machen uns zu einem attraktiven Arbeitgeber für talentierte Fachkräfte, die einen bedeutenden Beitrag zur Zukunft der Technologie leisten möchten.

NVIDIA Switzerland AG

Kontaktdaten:

NVIDIA Switzerland AG Recruiting-Team

Wir glauben, dass du diese Fähigkeiten brauchst, um Senior HPC and AI Network Software Architect mit Bravour zu bestehen

HPC (High-Performance Computing)
AI (Künstliche Intelligenz)
Systemprogrammierung
Paralleles oder verteiltes Rechnen
Hochleistungsnetzwerke
C++
Python