Veeda AI in Zürich, Switzerland is building the next generation of multimodal world models for Physical AI. The role focuses on optimizing multi-node video world model training and inference, managing tensor, context, and expert parallelism across PyTorch FSDP2 and Megatron-Core, not default options.You will profile end-to-end latency, GPU utilization, memory pressure, and kernel efficiency using PyTorch Profiler, Nsight Systems, and torch.utils.benchmark, then improve throughput via #J-18808-Ljbffr
ML Performance Engineer - Distributed Training & Inference in Zürich Arbeitgeber: Veeda AI
Veeda AI in Zürich bietet eine dynamische und innovative Arbeitsumgebung, in der Mitarbeiter die Möglichkeit haben, an der Spitze der Technologie im Bereich Physical AI zu arbeiten. Mit einem starken Fokus auf Teamarbeit und persönlicher Entwicklung fördert das Unternehmen eine Kultur des Wissensaustauschs und der kreativen Problemlösung. Zudem profitieren die Mitarbeiter von flexiblen Arbeitszeiten und der Chance, an spannenden Projekten mit modernsten Technologien zu arbeiten.