Nebius Group in Zürich seeks a Senior Machine Learning Engineer to own model and endpoint optimization from artifacts through production deployment. You will work on model internals, inference engines, serving architecture, and benchmarking to improve latency, throughput, memory efficiency, GPU utilization and cost per token while maintaining model quality.
This is a hands‑on role that collaborates with kernel and platform engineers to diagnose bottlenecks, compare serving configurations, and
#J-18808-Ljbffr
Senior ML Engineer, Inference & Optimization in Zürich Arbeitgeber: Nebius Group
Nebius ist ein hervorragender Arbeitgeber, der seinen Mitarbeitern die Möglichkeit bietet, an der Spitze der Cloud-Computing-Technologie zu arbeiten und die globale KI-Wirtschaft zu unterstützen. Mit einem wettbewerbsfähigen Gehalt, umfassenden Sozialleistungen und flexiblen Arbeitszeiten fördert Nebius eine dynamische und kollaborative Arbeitsumgebung, in der Initiative und Innovation geschätzt werden. Zudem gibt es zahlreiche Möglichkeiten zur beruflichen Weiterentwicklung, was Nebius zu einem attraktiven Arbeitsplatz für alle macht, die sich für KI und ML begeistern.