System Engineer (AI Platform)

System Engineer (AI Platform)

Basel Vollzeit 60000 - 80000 € / Jahr (geschätzt) Kein Homeoffice möglich
Experis Switzerland

Auf einen Blick

  • Aufgaben: Entwickle und optimiere skalierbare KI-Infrastrukturservices mit Fokus auf GPU-Workloads.
  • Unternehmen: Innovatives Unternehmen im Bereich KI-Infrastruktur mit zukunftsorientiertem Team.
  • Vorteile: Attraktives Gehalt, flexible Arbeitszeiten und Möglichkeiten zur beruflichen Weiterentwicklung.
  • Weitere Informationen: Dynamisches Umfeld mit hervorragenden Karrierechancen und Teamarbeit.
  • Warum dieser Job: Gestalte die Zukunft der KI-Plattformen und arbeite an spannenden Projekten.
  • Qualifikationen: Mindestens 5 Jahre Erfahrung in der IT-Systemadministration, insbesondere in Linux-Umgebungen.

Das prognostizierte Gehalt liegt zwischen 60000 - 80000 € pro Jahr.

Für einen Kunden suchen wir derzeit einen erfahrenen System Engineer für die AI-Plattform, der einem zukunftsorientierten Infrastrukturteam beitritt. In dieser Rolle spielen Sie eine Schlüsselrolle beim Aufbau, Betrieb und der Weiterentwicklung von unternehmensgerechten AI-Plattformen und Infrastrukturservices.

Ihre Verantwortlichkeiten:

  • Entwerfen, Implementieren und kontinuierliches Verbessern skalierbarer AI-Infrastrukturservices mit Fokus auf GPU-beschleunigte Workloads
  • Aufbauen, Betreiben und Warten von Unternehmens-AI-Plattformen basierend auf Technologien wie Kubernetes und OpenShift zur Unterstützung von Modellbereitstellung und Inferenz
  • Verwalten und Optimieren von Hochleistungsrechnerumgebungen (HPC), einschließlich sowohl Bare-Metal- als auch virtualisierten GPU-Infrastrukturen
  • Untersuchen, Troubleshooting und Lösen komplexer Infrastrukturvorfälle über Hardware, Betriebssysteme und Plattformdienste hinweg
  • Partnerschaft mit Datenwissenschafts- und Engineering-Teams zur Bereitstellung und Wartung der Infrastruktur, die für AI-Entwicklungs- und Produktions-Workloads erforderlich ist
  • Durchführen kritischer Betriebsaktivitäten und Teilnahme an einer Rufbereitschaft, um die Verfügbarkeit und Zuverlässigkeit der Plattform sicherzustellen

Ihr Profil:

  • Abschluss in Informatik oder eine vergleichbare technische Qualifikation
  • Mindestens 5 Jahre Erfahrung in der IT-Systemadministration, davon mindestens 3 Jahre mit Fokus auf Linux-Umgebungen (vorzugsweise Red Hat Enterprise Linux)
  • Starke Automatisierungs- und Skriptfähigkeiten mit Technologien wie Shell, Python und Ansible
  • Umfangreiche Kenntnisse von GPU-Architekturen und Interconnect-Technologien, einschließlich NVLink und PCIe-basierten Umgebungen
  • Praktische Erfahrung mit Container-Orchestrierung und Infrastructure-as-Code-Lösungen wie Kubernetes, Terraform und ArgoCD
  • Vertrautheit mit modernen Observabilitäts- und Überwachungstools, einschließlich Prometheus, Grafana und DCGM Exporter
  • Verständnis von ITIL-basierten Betriebsprozessen und Best Practices
  • Stark analytisches Denken mit hervorragenden Problemlösungsfähigkeiten, hohem Verantwortungsbewusstsein und der Fähigkeit, in anspruchsvollen Umgebungen effektiv zu arbeiten
  • Teamorientierter Fachmann mit ausgezeichneten Kommunikations- und Stakeholder-Management-Fähigkeiten
  • Fließend in Englisch

System Engineer (AI Platform) Arbeitgeber: Experis Switzerland

Als Senior Tax Manager EUCAN bei Takeda haben Sie die Möglichkeit, in einem dynamischen und unterstützenden Arbeitsumfeld zu arbeiten, das auf Zusammenarbeit und Innovation setzt. Wir bieten Ihnen nicht nur wettbewerbsfähige Vergütungen und umfassende Sozialleistungen, sondern auch zahlreiche Möglichkeiten zur beruflichen Weiterentwicklung und Weiterbildung. Unsere Unternehmenskultur fördert Vielfalt und Inklusion, sodass Sie in einem inspirierenden Umfeld arbeiten können, das Ihre Karriere voranbringt und gleichzeitig einen positiven Einfluss auf die Gesellschaft hat.

Experis Switzerland

Kontaktdaten:

Experis Switzerland Recruiting-Team

Wir glauben, dass du diese Fähigkeiten brauchst, um System Engineer (AI Platform) mit Bravour zu bestehen

AI-Plattform-Entwicklung
GPU-beschleunigte Workloads
Kubernetes
OpenShift
Hochleistungsrechnen (HPC)
Bare-Metal- und virtualisierte GPU-Infrastrukturen
Fehlerbehebung komplexer Infrastrukturvorfälle