Auf einen Blick
- Aufgaben: Entwickle innovative multimodale Modelle für interaktive Sprach- und Videoanwendungen.
- Unternehmen: Synthesia, führende KI-Videoplattform mit über 90% der Fortune 100 als Kunden.
- Vorteile: Attraktives Gehalt, flexible Arbeitszeiten und die Möglichkeit, an bahnbrechenden Projekten zu arbeiten.
- Weitere Informationen: Dynamisches Team mit exzellenten Wachstumschancen in einem innovativen Umfeld.
- Warum dieser Job: Gestalte die Zukunft der Kommunikation mit modernster Technologie und mache einen echten Unterschied.
- Qualifikationen: Erfahrung in generativen Modellen und starke Programmierkenntnisse in PyTorch.
Das prognostizierte Gehalt liegt zwischen 80000 - 100000 € pro Jahr.
Synthesia ist die weltweit führende KI-Video-Plattform für Unternehmen, die von über 90 % der Fortune 100 genutzt wird. Das Unternehmen wurde 2017 gegründet und hat seinen Hauptsitz in London, mit Büros und Teams in ganz Europa und den USA. Synthesia entwickelt Produkte, um die visuelle Kommunikation und die Entwicklung von Unternehmensfähigkeiten zu verbessern, damit Menschen besser arbeiten und im Mittelpunkt erfolgreicher Organisationen stehen können.
Über die Rolle
Synthesias langfristige Vision ist es, die besten menschlich-interaktiven Modelle zu entwickeln: Systeme, die nicht nur mit Menschen sprechen, sondern sie auch wahrnehmen und auf sie reagieren, indem sie auf die Aktionen und Emotionen eines Benutzers reagieren, nicht nur auf deren Worte. Heute verlassen sich über 60.000 Unternehmen auf unsere Plattform, und der nächste Schritt in dem, was wir ihnen anbieten können, hängt von Modellen ab, die Text, Audio und Video in ein einziges interaktives Erlebnis in Echtzeit kombinieren.
Als Staff Research Engineer werden Sie Teil des Voice-Teams innerhalb unserer über 40 Personen umfassenden F&E-Abteilung, aber Ihr Aufgabenbereich wird weit über die Stimme hinausgehen. Sie helfen dabei, diese breitere Vision über Teams hinweg zu definieren und voranzutreiben, schlagen ehrgeizige Forschungsrichtungen vor und übernehmen die direkte Verantwortung für das Design und die Implementierung der kritischsten Komponenten.
Was Sie tun werden:
- Gestalten Sie unseren Fahrplan zur Schaffung neuer Modellfähigkeiten und zur Freischaltung neuer Funktionen für unsere Kundenbasis, sowohl auf kurzen als auch auf langen Zeitrahmen.
- Schlagen Sie neuartige multimodale Systemarchitekturen (insbesondere Text und Stimme) vor.
- Entwickeln und bewerten Sie Streaming- und Gesprächssysteme für latenzinteraktive Sprach-Video-Synthese.
- Entwerfen Sie Lösungen, die emotionale Ausdruckskraft und natürliche Interaktion verstärken.
- Implementieren und bringen Sie Designs zum Leben, vom Pretraining bis zum Post-Training.
- Integrieren und testen Sie neuartige Architekturen (neuronale Codecs, Diffusion, Flow-Matching), um Realismus und Reaktionsfähigkeit zu verbessern.
- Definieren Sie neue Bewertungsmetriken für Gesprächssysteme, einschließlich latenzbewusster und interaktionsbasierter Messungen.
- Verfolgen Sie die neuesten Forschungen in audio-visueller Diffusion, autoregressiven Modellen, neuronalen Codecs und multimodalen LLMs.
- Kuratieren Sie neue Datensätze zur Ergänzung vorhandener Daten.
- Leiten Sie Post-Training-Initiativen wie DPO, Feinabstimmung und Destillation, um Modelle in Produktionsqualität zu bringen.
- Stellen Sie Modelle mit optimierter Laufzeit zur Verfügung, um Kunden zu bedienen, und gehen Sie anschließend auf deren Feedback ein.
Sie werden in dieser Rolle erfolgreich sein, wenn Sie:
- Die Fähigkeit haben, neuartige Ideen und Designs einzubringen, die das Feld der interaktiven multimodalen Systeme voranbringen.
- Ein starkes Verständnis für generative Modellierung haben, idealerweise angewendet auf sequenzielle oder multimodale Daten.
- Praktische Erfahrung mit großen Sprachmodellen oder ähnlichen transformer-basierten Architekturen haben.
- Eine hohe Kompetenz in PyTorch besitzen, einschließlich verteiltem Training und Modelloptimierung.
- Ein solides Verständnis von Zeitreihenmodellierung und Tokenisierung haben, vorzugsweise im Kontext von Audio, Sprache oder Video.
- Eine nachgewiesene Fähigkeit haben, schnell Prototypen zu erstellen, Hypothesen zu testen und effizient zu iterieren.
- Erwiesene Erfahrung im Training von Deep-Learning-Modellen von Anfang bis Ende haben, von der Datenvorbereitung bis zur Bewertung.
- Starke allgemeine Software-Engineering-Fähigkeiten besitzen, die Beiträge zu einer großen, gemeinsamen Forschungsinfrastruktur ermöglichen.
Besonders relevante Erfahrungen:
- Ein generatives Modell in ein Live-Produkt implementiert haben, das in bedeutendem Maßstab verwendet wird, nicht nur veröffentlicht oder prototypisiert.
- An Gesprächs- oder interaktiven Systemen gearbeitet haben, bei denen Latenz, Reaktionsfähigkeit und Benutzererfahrung erste Klasse waren, nicht nachträglich.
- An LLMs mit großflächigen Trainings gearbeitet haben, die zu Modellen mit anständigen Denkfähigkeiten führten.
- Ein Forschungsproblem von Anfang bis Ende besessen haben: von der Architekturvorschlag über Pretraining, Post-Training und Produktionsbereitstellung.
- Übergreifend mit Modalitäten oder Teams (z.B. Audio und Video oder Forschung und Produkt) zusammengearbeitet haben, um ein einheitliches System zu liefern.
Bonuspunkte für:
- Erfahrung mit Echtzeit- oder Streaming-Architekturen.
- Vertrautheit mit modernen Architekturen in der Audio- und Sprachgenerierung, wie z.B. Diffusionsmodelle, neuronale Codecs, Flow-Matching-Modelle oder autoregressive Decoder.
- Exzellenz in einer oder mehreren der folgenden Modalitäten: Stimme, Text, Video.
- Nachweis von originären Forschungsbeiträgen, wie Publikationen oder Open-Source-Arbeiten an erstklassigen Veranstaltungsorten (z.B. NeurIPS, CVPR, ICML, ICLR, Interspeech).
Staff Research Engineer - Multimodal Generative Modelling Arbeitgeber: Synthesia
Synthesia ist ein hervorragender Arbeitgeber, der innovative Technologien im Bereich Avatare und generative Medien vorantreibt. Mit einer flexiblen Arbeitskultur, die sowohl Büro- als auch Remote-Arbeitsmöglichkeiten in Deutschland, dem Vereinigten Königreich, der Schweiz und Irland bietet, fördert das Unternehmen die persönliche und berufliche Weiterentwicklung seiner Mitarbeiter. Die Möglichkeit, an spannenden Projekten zu arbeiten, die echte Nutzererlebnisse schaffen, sowie 25 Tage Urlaub und lokale Feiertage machen Synthesia zu einem attraktiven Arbeitsplatz für kreative Köpfe.
StudySmarter Expertenrat🤫
Wir sind der Meinung, dass du so Staff Research Engineer - Multimodal Generative Modelling erhalten könntest
✨Engagier dich in Entwickler-Communities!
Lass uns mal ehrlich sein: In der Software-Entwicklung sind Netzwerke Gold wert! Tummel dich in GitHub-Projekten, nehme an lokalen Meetups oder Hackathons teil und vernetze dich mit anderen Entwicklern. So steigerst du nicht nur deine Sichtbarkeit, sondern lernst auch die neuesten Trends und Technologien kennen.
✨Zeig deine Fähigkeiten!
Erstelle ein Portfolio, das deine besten Projekte und Code-Examples zeigt. Nichts überzeugt mehr als ein praktischer Beweis deiner Skills. Das kann auch helfen, bei Synthesia anzuklopfen, wenn du dich auf die Stelle als Staff Research Engineer - Multimodal Generative Modelling bewirbst – so wissen sie gleich, was sie von dir erwarten können!
✨Nutze Jobplattformen speziell für Tech-Jobs!
Plattformen wie Stack Overflow Jobs oder AngelsList sind perfekte Orte, um Vollzeitstellen in der Software-Entwicklung zu finden. Hier sind viele tolle Unternehmen auf der Suche nach Talenten wie uns, also schau regelmäßig vorbei und bewirb dich direkt über die Website.
✨Such dir Mentoren und Feedback!
Hol dir Feedback von erfahrenen Entwicklern, die dir Tipps geben können, was Recruiter wirklich suchen. Ob über LinkedIn oder persönliche Kontakte: Menschen, die sich in der Branche auskennen, können enorm wertvoll sein, um dir zu helfen, dich optimal auf deine Bewerbung bei Synthesia vorzubereiten!
Wir glauben, dass du diese Fähigkeiten brauchst, um Staff Research Engineer - Multimodal Generative Modelling mit Bravour zu bestehen
Einige Tipps für deine Bewerbung 🫡
Highlights deiner Coding-Skills:In der Software-Entwicklung kommt es auf konkrete Fähigkeiten an. Vergiss nicht, relevante Programmiersprachen und Frameworks in deinen Lebenslauf aufzunehmen. Zeig uns, was du kannst – vielleicht mit einem Link zu deinem GitHub-Profil oder einer Übersicht deiner Side Projects, die deine Programmierkenntnisse illustrieren.
Dokumentation deiner Erfolge:Gerade bei einer Vollzeitstelle in der Software-Entwicklung sind konkrete Ergebnisse Gold wert. Nenn uns Zahlen und Ergebnisse aus deinen vorherigen Projekten. Hast du den Code optimiert oder Systemfehler behoben? Solche Erfolge zeigen, dass du die Sprache der Entwickler sprichst und einen echten Mehrwert bringst.
Attraktive Projektbeschreibungen:Wenn du an Projekten gearbeitet hast, die hervorstechen, beschreibe sie ausführlich in deinem Lebenslauf. Was war das Problem, das du gelöst hast? Welche Technologien hast du eingesetzt? Das gibt uns einen klaren Einblick in deine Herangehensweise und Problemlösungsfähigkeiten.
Motivation zeigen:In deinem Anschreiben solltest du deine Motivation für die Stelle im Bereich Software-Entwicklung bei Synthesia klar herausstellen. Warum sprichst gerade du die Anforderungen für diese Vollzeitrolle an? Mach deutlich, was dich an der Arbeit bei uns reizt und wie du über das rein Technische hinaus wachsen möchtest.
Wie man sich auf ein Vorstellungsgespräch bei Synthesia vorbereitet
✨Technische Vorbereitung auf die Coding-Challenges
In der Software-Entwicklung sind technische Fragen oft ein zentraler Teil des Interviews. Macht euch mit Plattformen wie LeetCode oder HackerRank vertraut, um eure Problemlösungsfähigkeiten zu trainieren. Zeigt im Interview viel Selbstbewusstsein beim Erklären eurer Ansätze!
✨Das eigene Portfolio im besten Licht präsentieren
Stellt sicher, dass ihr ein aussagekräftiges Portfolio habt, das einige eurer besten Projekte zeigt. Seid bereit, darüber zu sprechen, was eure Rolle war, welche Technologien ihr verwendet habt und welche Herausforderungen es gab. Das gibt den Interviewern einen Einblick in eure praktische Erfahrung.
✨Teamfähigkeit und Kommunikation betonen
In einer Vollzeit-Position wird Kommunikation im Team sehr wichtig sein. Seid bereit, Beispiele aus der Vergangenheit zu teilen, in denen ihr effektiv im Team gearbeitet habt. Dies zeigt, dass ihr nicht nur technische Fähigkeiten habt, sondern auch gut ins Team passt.
✨Vorbereitung auf Fragen zur Software-Architektur
Bereitet euch darauf vor, Fragen zur Software-Architektur zu beantworten. Themen wie RESTful APIs, Microservices und Cloud-Architekturen können Teil eures Interviews sein. Zeigt euer Verständnis durch Diskussionen und Beispiele aus eurer bisherigen Arbeit oder Projekte.