Senior Research Scientist | Model Steering

Senior Research Scientist | Model Steering

Köln Vollzeit 75600 - 92400 € / Jahr (geschätzt) Kein Homeoffice möglich
D

Auf einen Blick

  • Aufgaben: Leite die Entwicklung von KI-Übersetzungsmodellen und führe spannende Forschungsprojekte durch.
  • Unternehmen: DeepL, ein innovatives Unternehmen im Bereich KI mit globaler Reichweite.
  • Vorteile: Flexible Arbeitszeiten, 30 Tage Urlaub, virtuelle Anteile und regelmäßige Teamevents.
  • Weitere Informationen: Dynamisches Team mit vielfältigen Hintergründen und hervorragenden Entwicklungsmöglichkeiten.
  • Warum dieser Job: Gestalte die Zukunft der KI und arbeite an bedeutenden Projekten mit echtem Einfluss.
  • Qualifikationen: Erfahrung in der Modellanpassung und starke Programmierkenntnisse erforderlich.

Das prognostizierte Gehalt liegt zwischen 75600 - 92400 € pro Jahr.

DeepL ist ein globales KI-Produkt- und Forschungsunternehmen, das sich auf den Aufbau sicherer, intelligenter Lösungen für komplexe Geschäftsprobleme konzentriert. Über 200.000 Geschäftskunden und Millionen von Einzelpersonen in 228 globalen Märkten vertrauen heute auf die Sprach-KI-Plattform von DeepL für menschenähnliche Übersetzungen, verbessertes Schreiben und Echtzeit-Sprachübersetzung.

Unsere Zielsetzung ist es, der globale Marktführer in vertrauenswürdiger, intelligenter KI-Technologie zu werden, indem wir Produkte entwickeln, die eine bessere Kommunikation fördern, Verbindungen schaffen und einen bedeutenden Einfluss ausüben. Um dies zu erreichen, benötigen wir talentierte Menschen wie Sie, die sich uns anschließen.

Wir suchen einen Senior Research Scientist, der das Fine-Tuning, das Post-Training, die Modellsteuerbarkeit und das Reinforcement Learning für die nächste Generation von DeepLs LLM-basierten Übersetzungsmodellen leitet. Dies ist eine hochwirksame, praktische Rolle für einen Forscher, der eine bedeutende Forschungsrichtung übernehmen, schnell Prototypen erstellen, großangelegte Experimente durchführen und Durchbrüche bis zur Produktion vorantreiben kann.

Ihre Hauptaufgabe besteht darin, wie wir Daten kombinieren und das Verhalten des Modells nach dem Pre-Training gestalten. Sie werden hochwertige Daten von menschlichen Experten mit synthetischen Daten verbinden und die Bemühungen leiten, unsere Übersetzungsmodelle steuerbar zu machen, indem sie benutzerdefinierte Anweisungen, Regeln und Kontexte befolgen.

Sie werden:

  • Die Entwicklung von Übersetzungsmodellen vorantreiben, die steuerbar sind und auf Benutzerpräferenzen, Regeln und Kontexte reagieren.
  • Praktische Forschung und Entwicklung im Bereich Post-Training für unsere Kernübersetzungsmodelle durchführen: überwachtes Fine-Tuning, Wissensdistillation, Präferenzoptimierung und Reinforcement Learning, das auf die Übersetzungsqualität abgestimmt ist.
  • Belohnungsmodelle und Bewertungsmodelle für Übersetzungen aufbauen, einschließlich rubric- und referenzbasierter Bewertung, sowie Belohnungshacking und Qualitätsbewertungsfehler untersuchen und mindern.
  • Eine Agenda für Modelle vorantreiben, die multimodale Inhalte und Kontexte verarbeiten, um die Übersetzungsqualität zu erhöhen.
  • Den gesamten Lebenszyklus der Modellauslieferung besitzen: Prototyping, Ablationen, Training, Evaluierung, Optimierung und Produktionsbereitstellung, wobei Sie eng mit der Technik zusammenarbeiten, um in Echtzeitsysteme in großem Maßstab zu liefern.
  • Starke Praktiken für Evaluierung, Reproduzierbarkeit, Überwachung und kontinuierliche Modellverbesserung in der Produktion etablieren.
  • Forscher und Ingenieure betreuen, praktische Zusammenarbeit fördern und die Standards für die Modellqualität erhöhen.

Qualitäten, die wir suchen:

  • Nachgewiesene Erfahrung in der Steuerung großer Modelle und der Befolgung von Anweisungen durch Identifizierung der effektivsten Methode zur Instillation eines bestimmten Verhaltens.
  • Tiefe, praktische Expertise im LLM-Post-Training, Wissensdistillation und/oder Reinforcement Learning.
  • Starke datenzentrierte Instinkte für den Aufbau von Pipelines für synthetische Daten und Präferenzdaten.
  • Erfahrung in der Gestaltung von Evaluierungs- und Belohnungssignalen unter Verwendung automatischer Metriken.
  • Ein praktischer Entwickler, der gerne Modelle trainiert, Experimente durchführt und ML-Systeme in die Produktion integriert.
  • Verantwortung für eine substanzielle Forschungsrichtung mit starker Ausführung und Erfahrung in der Betreuung anderer.
  • Starke Programmier- und Experimentierfähigkeiten (Python, PyTorch/JAX/Tensorflow).

Was wir bieten:

  • Diverses und international verteiltes Team.
  • Offene Kommunikation, regelmäßiges Feedback.
  • Hybrides Arbeiten, flexible Arbeitszeiten.
  • Virtuelle Anteile - eine Eigentumsperspektive in jeder Rolle.
  • Regelmäßige persönliche Teamevents.
  • Monatliche ganztägige Hack-Sessions.
  • 30 Tage Jahresurlaub.
  • Wettbewerbsfähige Vorteile.

Wenn diese Rolle und unsere Mission mit Ihnen übereinstimmen, zögern Sie nicht, sich zu bewerben – lassen Sie uns Ihr Potenzial gemeinsam entdecken!

Senior Research Scientist | Model Steering Arbeitgeber: DeepL

DeepL ist ein hervorragender Arbeitgeber, der eine dynamische und unterstützende Arbeitsumgebung bietet, in der Innovation und persönliches Wachstum gefördert werden. Mit flexiblen Arbeitszeiten und der Möglichkeit, remote zu arbeiten, ermöglicht DeepL seinen Mitarbeitern, ihre Work-Life-Balance zu optimieren, während sie an bedeutungsvollen Projekten im Bereich KI-Technologie arbeiten. Die Unternehmenskultur basiert auf offener Kommunikation und Teamzusammenhalt, was durch regelmäßige Teamevents und monatliche Hackdays unterstützt wird, um Kreativität und Zusammenarbeit zu fördern.

D

Kontaktdaten:

DeepL Recruiting-Team

Wir glauben, dass du diese Fähigkeiten brauchst, um Senior Research Scientist | Model Steering mit Bravour zu bestehen

Forschung und Entwicklung von Übersetzungsmodellen
Feinabstimmung von Modellen
Reinforcement Learning
Wissen-Destillation
Datenpipeline-Entwicklung
Bewertungs- und Belohnungssignale entwerfen
Modellarchitekturen für große Modelle