Senior AI Infrastructure & Platform Engineer

Senior AI Infrastructure & Platform Engineer

Vollzeit 63000 - 77000 € / Jahr (geschätzt) Kein Homeoffice möglich
A

Auf einen Blick

  • Aufgaben: Gestalte und verbessere AI-Infrastrukturplattformen für maschinelles Lernen.
  • Unternehmen: Stabiler Finanzdienstleister mit internationaler Präsenz und kollaborativer Kultur.
  • Vorteile: Überdurchschnittliche Versicherungsleistungen, Gesundheitsbeiträge und Weiterbildungsmöglichkeiten.
  • Weitere Informationen: Dynamisches Umfeld mit exzellenten Karrierechancen.
  • Warum dieser Job: Arbeite an innovativen AI-Projekten und forme die Zukunft der Technologie.
  • Qualifikationen: Erfahrung in Linux, Kubernetes und GPU-Architekturen erforderlich.

Das prognostizierte Gehalt liegt zwischen 63000 - 77000 € pro Jahr.

Beschreibung des Unternehmens

Unser Kunde ist eine etablierte Finanzinstitution, die für ihre langjährige Stabilität, internationale Präsenz und ihr Engagement für operative Exzellenz bekannt ist. Die Organisation fördert eine kollaborative Kultur, schätzt Expertise und unterstützt kontinuierliche Verbesserungen in ihren globalen Technologie- und Datenfunktionen.

Rolle & Verantwortlichkeiten

Als Senior AI Infrastructure & Platform Engineer spielen Sie eine Schlüsselrolle bei der Gestaltung, dem Betrieb und der kontinuierlichen Verbesserung von unternehmensgerechten AI-Infrastrukturplattformen, die fortschrittliche maschinelles Lernen und generative AI-Initiativen unterstützen. Sie arbeiten eng mit Infrastruktur-, Plattformengineering- und Data-Science-Teams zusammen, um hochverfügbare GPU-fähige Umgebungen und skalierbare Containerplattformen zu erstellen, die große Modelltrainings- und Inferenzlasten unterstützen können.

Hauptverantwortlichkeiten:

  • Entwurf, Implementierung und Betrieb von GPU-fähigen Infrastrukturplattformen für AI- und maschinelles Lernen-Workloads
  • Verwaltung und Optimierung von Kubernetes- und OpenShift-Plattformen zur Unterstützung von Unternehmens-AI-Diensten
  • Management von Hochleistungsrechnerumgebungen (HPC), einschließlich Bare-Metal- und virtualisierten GPU-Systemen
  • Entwicklung und Wartung von Infrastrukturautomatisierung unter Verwendung von Ansible, Terraform und GitOps-Methoden
  • Fehlerbehebung komplexer Plattformprobleme, die Linux, Netzwerke, Speicher, Kubernetes und GPU-Architekturen betreffen
  • Unterstützung von AI- und Data-Science-Teams bei der Bereitstellung von Plattformen, Ressourcenzuteilung und operativer Exzellenz
  • Implementierung von Plattformüberwachungs- und Beobachtbarkeit-Lösungen
  • Teilnahme am Incident Management und an Bereitschaftsdiensten

Kandidatenprofil

Sie haben einen Hochschulabschluss in Informatik oder einem verwandten Fachgebiet und bringen mehrere Jahre aktuelle, praktische Erfahrung im Betrieb von großangelegten Linux- und containerisierten Infrastrukturumgebungen mit.

Zusätzlich:

  • Mindestens 5 Jahre Erfahrung in der Unternehmensinfrastrukturtechnik
  • Mindestens 3 Jahre praktische Erfahrung in der Verwaltung von Red Hat Enterprise Linux-Umgebungen
  • Nachweisliche Erfahrung im Betrieb von Kubernetes- und/oder OpenShift-Plattformen in Produktionsumgebungen
  • Starke praktische Erfahrung mit Terraform, ArgoCD und Ansible
  • Praktische Erfahrung in der Unterstützung von NVIDIA GPU-Infrastrukturen und GPU-fähigen Rechenumgebungen
  • Kenntnisse über GPU-Architekturen und -Technologien wie NVLink, PCIe-Switching und GPU-Virtualisierung
  • Erfahrung mit Prometheus, Grafana und Infrastrukturüberwachungslösungen
  • Starke Shell- und Skriptfähigkeiten
  • Erfahrung in stark regulierten Unternehmensumgebungen ist von Vorteil
  • Fließend in Englisch; Deutsch von Vorteil
  • Gültige CH-Arbeitsbewilligung oder EU/EFTA-Staatsbürgerschaft erforderlich
  • Bereitschaft, 100% vor Ort zu arbeiten

Vorteile:

  • Zentrale Bürolagen in der ganzen Schweiz
  • Überdurchschnittliche Versicherungsdeckung, die vollständig von unserem Kunden getragen wird
  • Beitrag zur Krankenversicherung und Essenszulage
  • Ausgezeichnete Möglichkeiten zur Weiterbildung und persönlichen Entwicklung
  • Internationales Umfeld

Senior AI Infrastructure & Platform Engineer Arbeitgeber: ALBEDIS

Notre entreprise est un employeur de choix, offrant à ses employés un environnement de travail dynamique et innovant dans le domaine des technologies de sécurité. En tant que Technicien en sécurité électronique, vous bénéficierez d'une formation continue et d'opportunités de développement professionnel tout en travaillant sur des projets variés qui impactent directement la sécurité des clients. Située dans le canton de Fribourg, notre équipe valorise l'autonomie, la rigueur et un excellent service client, garantissant ainsi une expérience enrichissante et gratifiante pour tous nos collaborateurs.

A

Kontaktdaten:

ALBEDIS Recruiting-Team

Wir glauben, dass du diese Fähigkeiten brauchst, um Senior AI Infrastructure & Platform Engineer mit Bravour zu bestehen

GPU-enabled Infrastructure Design
Kubernetes Administration
OpenShift Management
High-Performance Computing (HPC)
Infrastructure Automation with Ansible
Terraform Expertise
GitOps Methodologies