Auf einen Blick
- Aufgaben: Wende Reinforcement Learning an, um Robotermodelle für Manipulation und Fortbewegung zu optimieren.
- Unternehmen: Agile Robots, ein internationales High-Tech-Unternehmen mit innovativer Kultur.
- Vorteile: Attraktives Gehalt, Gesundheitsleistungen, 100 € monatlich für Mobilität und Lernen.
- Weitere Informationen: Dynamisches Team aus über 60 Nationalitäten mit vielen Entwicklungsmöglichkeiten.
- Warum dieser Job: Gestalte die Zukunft der Robotik und arbeite an spannenden Projekten mit Experten.
- Qualifikationen: Master in Robotik oder verwandtem Bereich und 2-5 Jahre Erfahrung in Robotik.
Das prognostizierte Gehalt liegt zwischen 63000 - 77000 € pro Jahr.
Die AI Research & Development Group von Agile Robots sucht einen (Senior) Reinforcement Learning Engineer (m/w/d) für Manipulation & Lokomotion, der Reinforcement Learning auf bestehende Vision-Language-Action (VLA) und Steuerungsmodelle anwendet, um diese zuverlässig für geschickte Manipulation, Ganzkörpersteuerung und humanoides Gehen auf echtem Hardware zu machen. Die Modelle selbst werden an anderer Stelle in der Organisation entwickelt; diese Rolle beginnt mit einer bereits trainierten Politik und konzentriert sich darauf, sie zuverlässig auf dem Zielroboter und der Aufgabe auszuführen.
Ihre Verantwortlichkeiten
- Politikverfeinerung: Anwendung von Reinforcement Learning auf ein bereits trainiertes Vision-Language-Action (VLA) oder anderes Manipulations-/Steuerungsmodell, um dessen Zuverlässigkeit bei einer spezifischen Zielaufgabe zu verbessern.
- Geschickte Manipulation: Verantwortung für die Zuverlässigkeitsarbeit auf Basis von RL für kontaktreiche Manipulationsaufgaben, einschließlich Greifen und feiner Objektinteraktion.
- Ganzkörper- & Lokomotion: Anwendung von Reinforcement Learning auf die Ganzkörpersteuerung und humanoides Gehen, Verbesserung des Gleichgewichts und koordinierter Bewegungen unter realen physikalischen Einschränkungen.
- Belohnungs- & Aufgabendefinition: Definition der Belohnungsstrukturen und Aufgabenspezifikationen, die bestimmen, was als zuverlässige Leistung für jede Politikverfeinerungsanstrengung zählt.
- Sim-to-Real-Transfer: Training und Validierung von Politiken in Simulationen, gefolgt von deren Anpassung zur Schließung der Leistungsdifferenz auf dem physischen Roboter.
- Fehlerdiagnose: Identifizierung, wo eine verfeinerte Politik in der Praxis versagt, und Anpassung des Belohnungsdesigns, der Aufgabenstruktur oder des Trainingsansatzes als Reaktion.
Wesentliche Fähigkeiten
- Hintergrund: Master-Abschluss in Robotik, Informatik, Maschinenlernen oder einem verwandten Bereich oder eine gleichwertige Kombination aus formaler Ausbildung und Berufserfahrung.
- Berufserfahrung: 2 bis 5+ Jahre Berufserfahrung in Robotik oder Robot Learning Engineering.
- Reinforcement Learning: Praktisches Verständnis, wie man eine bereits trainierte Vision-Language-Action (VLA) oder andere Manipulations-/Steuerungspolitik durch Reinforcement Learning verfeinert oder optimiert.
- Robotik-Grundlagen: Praktische Erfahrung mit Roboter-Manipulation oder beinbasierter Lokomotion auf echter, physischer Hardware.
- Sim-to-Real-Transfer: Erfahrung im Training von Politiken in Simulationen und deren Übertragung auf physische Roboter, einschließlich eines praktischen Verständnisses, wo dieser Transfer typischerweise scheitert.
- Körperliche Interaktion: Solides Verständnis der Kontaktdynamik und physikalischen Einschränkungen, die für Manipulation oder beinbasierte Lokomotion relevant sind.
Wünschenswerte Fähigkeiten
- Breitere Modellkenntnisse: Vertrautheit mit Politikarchitekturen über VLA hinaus, wie z.B. diffusionsbasierte oder transformerbasierte Steuerungsmodelle.
- RL-Tools: Vertrautheit mit Reinforcement Learning-Bibliotheken und Simulationsumgebungen, die für das Robot Learning verwendet werden, wie Isaac Lab oder Stable Baselines.
- Forschungsbeitrag: Beitrag zu begutachteten Robotik- oder Maschinenlern-Forschungen, z.B. bei CoRL, ICRA oder RSS.
- Humanoide Bereitstellung: Erfahrung in der Bereitstellung erlernter Politiken auf einer bipedalen oder hochgradig beweglichen Roboterplattform.
Was wir bieten
- Dynamisches High-Tech-Unternehmen kombiniert mit finanzieller Solidität und erstklassigen Investoren.
- Ein interdisziplinäres, internationales Team mit über 60 verschiedenen Nationalitäten in einer kollaborativen Arbeitsumgebung.
- Viele Entwicklungsmöglichkeiten im Kontext unseres fortwährenden Wachstums.
- Herausfordernde Aufgaben und wirkungsvolle Projekte neben Experten, die professionelles und persönliches Wachstum ermöglichen.
- Corporate Benefits Programm, das Gesundheit, Mobilität und Lernen mit 100 € netto pro Monat abdeckt.
- Moderne Bürofazilitäten mit einer Dachterrasse mit Blick auf München, kostenlose Getränke & Obst sowie regelmäßige Unternehmensveranstaltungen tragen zu einem guten Arbeitsumfeld bei.
Über uns
Agile Robots SE ist ein internationales High-Tech-Unternehmen mit Sitz in München, Deutschland, mit einem Produktionsstandort in Kaufbeuren und mehr als 2300 Mitarbeitern weltweit. Unsere Mission ist es, die Lücke zwischen künstlicher Intelligenz und Robotik zu schließen, indem wir Systeme entwickeln, die modernste Kraft-Moment-Sensorik und führende Bildverarbeitungstechnologie kombinieren. Diese einzigartige Kombination von Technologien ermöglicht es uns, benutzerfreundliche und erschwingliche robotische Lösungen anzubieten, die intelligente Präzisionsmontage ermöglichen. Dies wird durch unsere Mitarbeiter möglich gemacht, die jeden Tag ihr Bestes mit Kreativität und Begeisterung geben. Werden Sie Teil dieses Teams und gestalten Sie die Zukunft der Robotik mit uns!
Wir sind stolz auf unsere Vielfalt und freuen uns auf Ihre Bewerbung, unabhängig von Geschlecht und sexueller Identität, Nationalität, Ethnie, Religion, Alter oder Behinderung.
(Senior) Reinforcement Learning Engineer (m/f/d) Manipulation & Locomotion Arbeitgeber: Agile Robots SE
Agile Robots SE ist ein hervorragender Arbeitgeber, der seinen Mitarbeitern in München und Kaufbeuren nicht nur ein dynamisches und innovatives Arbeitsumfeld bietet, sondern auch zahlreiche Möglichkeiten zur persönlichen und beruflichen Weiterentwicklung. Mit einem starken Fokus auf Teamarbeit und interdisziplinäre Zusammenarbeit fördert das Unternehmen eine Kultur der Kreativität und des Engagements, während es gleichzeitig attraktive Benefits und flexible Arbeitsmodelle bereitstellt, um die Work-Life-Balance zu unterstützen.