Auf einen Blick
- Aufgaben: Verwalte den technischen Release-Pfad von Apertus-Modellen und integriere sie in die Open-Source-Community.
- Unternehmen: Führende technische Universität mit Zugang zu einem der größten AI-fähigen Supercomputer Europas.
- Vorteile: Attraktive Anstellungsbedingungen, flexible Arbeitszeiten und umfassende Weiterbildungsmöglichkeiten.
- Weitere Informationen: Dynamisches Umfeld mit hervorragenden Karrieremöglichkeiten und Zusammenarbeit mit führenden Forschern.
- Warum dieser Job: Arbeite an bahnbrechenden KI-Projekten und trage zur Open-Source-Entwicklung bei.
- Qualifikationen: MSc oder PhD in Informatik oder verwandten Bereichen; starke Python-Kenntnisse erforderlich.
Das prognostizierte Gehalt liegt zwischen 80000 - 100000 € pro Jahr.
Wir suchen einen erfahrenen Ingenieur, der den technischen Veröffentlichungsweg der Apertus-Modelle verantwortet. Der ideale Kandidat wird Apertus in das Open-Source-Inferenz-Ökosystem integrieren, quantisierte Varianten erstellen und sicherstellen, dass jede Veröffentlichung sofort für die Community funktioniert.
Diese Rolle erfordert starke Python- und Softwareengineering-Fähigkeiten, Erfahrung mit LLM-Inferenz-Stacks und eine nachweisliche Erfolgsbilanz bei Open-Source-Beiträgen.
Projekt Hintergrund
Wir trainieren offene Grundmodelle mit Hunderten von Milliarden von Parametern auf Tausenden von GPUs auf einem der größten AI-fähigen Supercomputer in Europa. Das Team besteht aus mehr als einem Dutzend Vollzeitingenieuren, die eng mit führenden Forschern von EPFL und ETH Zürich zusammenarbeiten, hat die Modelle Apertus 1 und Apertus 1.5 veröffentlicht und arbeitet mit über dreißig akademischen Partnern zusammen, um vollständig offene (Open Source), verantwortungsvoll trainierte, mehrsprachige, multimodale KI-Modelle für Forschung und Industrie bereitzustellen.
Apertus wird auf Alps, der Supercomputing-Infrastruktur des Schweizerischen Nationalen Supercomputing-Zentrums (CSCS), trainiert und entwickelt. Diese Rolle befindet sich an der Schnittstelle zwischen dem Trainingsteam und der Open-Source-Community: Die soziale Seite des Community-Engagements wird von unserem Community-Manager übernommen, während diese Rolle den technischen Veröffentlichungsweg verantwortet.
Aufgabenbeschreibung
Der Ingenieur wird sicherstellen, dass Apertus-Veröffentlichungen im gesamten Open-Source-LLM-Ökosystem funktionieren, von serverbasierten Inferenzlösungen bis hin zu persönlichen Bereitstellungen.
- Upstream-Integration und Release-Engineering
- Verwalten des technischen Veröffentlichungsweges der trainierten Apertus-Modelle: Checkpoint-Konvertierung und Vorbereitung von Veröffentlichungsartefakten (Gewichte, Konfigurationen, Tokenizer, Modellkarten) zusammen mit dem Trainingsteam.
- Implementierung und Unterstützung der Apertus-Modellarchitekturen in Community-Bibliotheken wie Hugging Face Transformers, vLLM, SGLang und llama.cpp und Begleitung dieser Beiträge durch die Überprüfung, damit die Unterstützung durch die Community gewährleistet ist.
- Überprüfen der Kompatibilität neuer Veröffentlichungen mit den wichtigsten Inferenz-Engines und Modellformaten.
- Koordinierung des Veröffentlichungszeitpunkts und technischer Materialien mit dem Community-Manager.
- Quantisierung
- Erstellen quantisierter Varianten von veröffentlichten Modellen (z.B. FP8, INT4/AWQ/GPTQ, GGUF), die für Server- und persönliche Bereitstellungen geeignet sind.
- Validierung quantisierter Varianten anhand von Evaluierungsbenchmarks, um sicherzustellen, dass die Qualität erhalten bleibt.
- Dokumentation und Beispiele
- Bereitstellung von Beispielskripten und Referenzkonfigurationen, die zeigen, wie man Apertus-Modelle mit vLLM, SGLang und Transformers bereitstellt und verwendet.
- Unterstützung persönlicher und lokaler Bereitstellungsökosysteme wie LM Studio, Ollama und llama.cpp.
- Pflege der Bereitstellungsdokumentation und Troubleshooting-Leitfäden für die Community.
Profil
Erforderlich:
- MSc oder PhD in Informatik, Datenwissenschaft, künstlicher Intelligenz, maschinellem Lernen oder einem verwandten Bereich.
- Außergewöhnliche BSc-Kandidaten mit starker Ingenieurserfahrung werden ebenfalls berücksichtigt.
- Starke Python- und Softwareengineering-Fähigkeiten, einschließlich Erfahrung mit Open-Source-Beitragsabläufen (Pull-Requests, Code-Review, CI).
- Erfahrung mit LLM-Inferenz-Stacks wie Hugging Face Transformers, vLLM oder SGLang.
- Starke Zusammenarbeit und Kommunikationsfähigkeiten sowie die Fähigkeit, in Forschungs-, Ingenieur- und communityorientierten Teams zu arbeiten.
- Praktische Erfahrung in den Kernbereichen dieser Rolle ist erforderlich; dies kann projekt- oder studienbasiert sein; formale Berufserfahrung wird bevorzugt.
- Ein hohes Maß an Flexibilität: Prioritäten, Werkzeuge und tägliche Aufgaben ändern sich mit Trainingsplänen, Veröffentlichungen und einem sich schnell bewegenden Feld.
- Eine nachweisliche Erfolgsbilanz bei zusammengeführten Beiträgen zu ML- oder Inferenzbibliotheken (z.B. Transformers, vLLM, SGLang, llama.cpp).
Stark bevorzugt:
- Erfahrung in der Konvertierung von Modellen zwischen Formaten und Frameworks (z.B. Megatron-LM-Checkpoints, safetensors, GGUF).
- Vertrautheit mit persönlichen und lokalen Bereitstellungstools wie LM Studio, Ollama oder llama.cpp.
- Erfahrung im Schreiben von entwicklerorientierter Dokumentation und Beispielcode.
Schön zu haben:
- Veröffentlichte Forschung in den für diese Rolle relevanten Bereichen oder Vertrautheit mit kürzlich veröffentlichter Forschung zu diesen Themen.
- Erfahrung in der Quantisierung von Modellen ohne Leistungsabfall (FP8, INT4, AWQ, GPTQ) und der Bewertung quantisierter Modelle.
- Erfahrung mit LLM-Evaluierungswerkzeugen und Benchmark-Pipelines.
- Vertrautheit mit GPU-Inferenzleistungsoptimierung und Bereitstellung in großem Maßstab.
- Erfahrung mit Apple Silicon / MLX oder anderen Verbraucher-Hardware-Inferenzzielen.
Wir bieten:
- Ein anregendes akademisches Umfeld an einer der weltweit führenden technischen Universitäten.
- Zugang zu Alps, einem der größten AI-fähigen Supercomputer in Europa.
- Die Möglichkeit, neben führenden Forschern auf diesem Gebiet zu arbeiten und zu interagieren.
- Zusammenarbeit mit Top-Forschern und Ingenieuren von EPFL, ETH Zürich, CSCS und anderen Schweizer Institutionen.
- Attraktive Arbeitsbedingungen und umfassende Vorteile, einschließlich der Pensionspläne von ETH Zürich/EPFL.
- Flexible Arbeitszeiten, einschließlich Optionen für Remote-Arbeit.
- Berufliche Entwicklungsmöglichkeiten, einschließlich Teilnahme an Konferenzen und spezialisierter Schulungen.
- Die Chance, zu Open-Source-Projekten mit globaler Wirkung beizutragen.
- Teil der souveränen KI-Entwicklung der Schweiz zu sein und an Technologien mit nationaler Bedeutung zu arbeiten.
- Die Rolle kann entweder in Lausanne an der EPFL oder in Zürich an der ETH Zürich angesiedelt sein.
Apertus Engineer: Deployment Arbeitgeber: Immigration Policy Lab
Die Immigration Policy Lab in Zürich ist ein hervorragender Arbeitgeber, der Ihnen die Möglichkeit bietet, in einem dynamischen und unterstützenden Umfeld zu arbeiten. Unsere Forschungsstation Früebüel fördert nicht nur Ihre berufliche Weiterentwicklung durch gezielte Schulungen und Workshops, sondern bietet auch attraktive Vorteile wie ÖV-Abonnemente und Car Sharing, um Ihre Work-Life-Balance zu unterstützen. Werden Sie Teil eines engagierten Teams, das sich leidenschaftlich für innovative landwirtschaftliche Lösungen einsetzt.
StudySmarter Expertenrat🤫
Wir sind der Meinung, dass du so Apertus Engineer: Deployment erhalten könntest
✨Netzwerken in der Entwicklerszene
Besuche lokale Meetups oder Hackathons in der Software-Entwicklung, um direkt mit Leuten aus der Branche in Kontakt zu treten. Dort hast du die Chance, nicht nur von anderen zu lernen, sondern auch persönliche Eindrücke bei potenziellen Arbeitgebern wie Immigration Policy Lab zu hinterlassen.
✨Open Source Beiträge leisten
Engagiere dich in Open-Source-Projekten, um deine Fähigkeiten zu zeigen und für Immigration Policy Lab sichtbar zu werden. Das ist nicht nur eine super Möglichkeit, praktische Erfahrungen zu sammeln, sondern auch eine tolle Möglichkeit, sich einen Namen in der Entwicklergemeinschaft zu machen.
✨Auf Praktikumsprogramme achten
Halte Ausschau nach spezifischen Programmen für befristete Stellen, die viele Unternehmen anbieten, um junge Talente zu fördern. Diese Fenster sind oft zeitlich begrenzt, also mach dich bereit, wenn die Bewerbungen öffnen, und verpasse nicht die Gelegenheit, dich bei Immigration Policy Lab zu bewerben!
✨Portfolio aufbauen und sichtbar machen
Erstelle dir ein starkes Portfolio, das deine besten Projekte zeigt. Teile dieses Portfolio in Entwickler-Communities und auf Plattformen wie GitHub, damit Unternehmen wie Immigration Policy Lab sofort sehen, was du kannst. Das steigert deine Chancen, in der Software-Entwicklung aufzufallen!
Wir glauben, dass du diese Fähigkeiten brauchst, um Apertus Engineer: Deployment mit Bravour zu bestehen
Einige Tipps für deine Bewerbung 🫡
Dein GitHub ist dein bester Freund!:Für eine befristete Stelle in der Software-Entwicklung ist dein GitHub-Profil super wichtig. Zeig uns deine besten Projekte und deinen Code! Wenn du Seitenprojekte oder Beiträge zu Open-Source-Projekten hast, pack die unbedingt in deine Bewerbung, das gibt uns einen tollen Einblick in deine Fähigkeiten.
Skills, Skills, Skills!:Mach eine Liste deiner technischen Skills und Technologien, die du beherrschst. In der Software-Entwicklung ist es wichtig, diese klar und präzise in deinem Lebenslauf zu präsentieren. Liste Frameworks, Programmiersprachen und Tools auf, die du nutzt, und versichere dich, dass sie zum Job bei Immigration Policy Lab passen!
Deine Motivation zeigt, dass du lernbereit bist:In deinem Anschreiben solltest du darauf eingehen, warum du dich für die befristete Stelle bei Immigration Policy Lab interessierst und was du dir von der Erfahrung erhoffst. Heb hervor, wie diese Position dir helfen kann, deine Fähigkeiten zu verbessern und neue Technologien zu lernen.
Projektbesprechung und persönliche Note:Wenn du ein Portfolio hast, das deine Entwicklungsprojekte zeigt, füge das unbedingt an. Außerdem kannst du in deinem Anschreiben erwähnen, warum du gerade bei Immigration Policy Lab arbeiten möchtest und wie du zur Unternehmenskultur passt. Das gibt uns einen persönlicheren Eindruck von dir als Bewerber!
Wie man sich auf ein Vorstellungsgespräch bei Immigration Policy Lab vorbereitet
✨Code die Erwartungen!
Bei einem Interview in der Software-Entwicklung solltest du bereit sein, dein Coding-Know-how unter Beweis zu stellen. Mache dich mit typischen Coding-Challenges und Systemdesign-Fragen vertraut, die dir während des Interviews gestellt werden könnten. Vielleicht gibt es sogar Live-Coding-Sessions, also übe, deinen Denkprozess laut zu kommunizieren!
✨Bring dein Portfolio mit!
Auch wenn es sich um eine befristete Stelle handelt, ist es wichtig, deinem potenziellen Arbeitgeber dein Können zu zeigen. Stelle ein Portfolio mit deinen besten Projekten zusammen – idealerweise solche, die relevant für Immigration Policy Lab sind. Denk daran, dass du nicht nur die Lösungen präsentieren solltest, sondern auch den Prozess und die Technologien, die du verwendet hast.
✨Sei flexibel und lernwillig!
Für befristete Stellen suchen Unternehmen oft nach Kandidaten, die schnell dazulernen können. Betone in deinem Interview deine Lernbereitschaft und vielleicht Beispiele, wie du in der Vergangenheit neue Technologien oder Programmiersprachen schnell beherrscht hast. Das zeigt, dass du gut ins Team passt und bereit bist, dich den Herausforderungen zu stellen.
✨Frage nach Team-Tools und Methoden!
Informiere dich über die Tools und Arbeitsmethoden, die das Team bei Immigration Policy Lab verwendet. Hast du Erfahrung mit agilem Arbeiten oder Tools wie Jira, Git oder Slack? Wenn du gezielt Fragen zu diesen Aspekten stellst, zeigst du dein Interesse an der Teamdynamik und wie du dich schnell einbringen kannst.