Member of Technical Staff, Synthetic Data

Member of Technical Staff, Synthetic Data

Vollzeit 60000 - 80000 € / Jahr (geschätzt) Kein Homeoffice möglich
C

Auf einen Blick

  • Aufgaben: Entwickle und optimiere synthetische Datenpipelines für fortschrittliche Sprachmodelle.
  • Unternehmen: Cohere, ein innovatives Unternehmen im Bereich KI mit einer offenen und inklusiven Kultur.
  • Vorteile: Wettbewerbsfähiges Gehalt, Gesundheitsleistungen, flexible Remote-Arbeit und persönliche Entwicklungsangebote.
  • Weitere Informationen: Dynamisches Team mit exzellenten Karrieremöglichkeiten und 6 Wochen Urlaub.
  • Warum dieser Job: Gestalte die Zukunft der KI und mache einen echten Unterschied in der Datenverarbeitung.
  • Qualifikationen: Starke Software-Engineering-Fähigkeiten, Erfahrung mit Python und Datenpipelines.

Das prognostizierte Gehalt liegt zwischen 60000 - 80000 € pro Jahr.

Wer sind wir? Unsere Mission ist es, Intelligenz zu skalieren, um der Menschheit zu dienen. Wir trainieren und setzen fortschrittliche Modelle für Entwickler und Unternehmen ein, die KI-Systeme entwickeln, um magische Erlebnisse wie Inhaltsgenerierung, semantische Suche, RAG und Agenten zu ermöglichen. Wir glauben, dass unsere Arbeit entscheidend für die weit verbreitete Akzeptanz von KI ist. Wir sind besessen von dem, was wir bauen. Jeder von uns ist dafür verantwortlich, die Fähigkeiten unserer Modelle und den Wert, den sie für unsere Kunden schaffen, zu steigern. Wir arbeiten hart und schnell, um das Beste für unsere Kunden zu tun. Cohere ist ein Team von Forschern, Ingenieuren, Designern und mehr, die leidenschaftlich für ihr Handwerk sind. Jede Person gehört zu den Besten der Welt in dem, was sie tut. Wir glauben, dass eine vielfältige Perspektive eine Voraussetzung für den Bau großartiger Produkte ist. Schließen Sie sich uns an und gestalten Sie die Zukunft!

Warum diese Rolle? Als Machine Learning Engineer, der auf synthetische Daten spezialisiert ist, spielen Sie eine entscheidende Rolle bei der Entwicklung der synthetischen Datenpipeline, die für Cohere’s fortschrittliche Sprachmodelle von entscheidender Bedeutung ist. Ihre Aufgaben umfassen das End-to-End-Management synthetischer Daten, einschließlich der Wartung und Optimierung der synthetischen Datenpipeline, Datenanalyse und -generierung sowie die Durchführung von Datenablations und Modellauswertungen zur Bewertung der Datenqualität. Sie werden mit verschiedenen Webdaten und Codierungsdaten arbeiten und diese mithilfe generativer Modelle transformieren, um die Token-Effizienz und die Modellqualität zu verbessern. Durch die Kombination von Forschung und Ingenieurwesen überbrücken Sie die Lücke zwischen Rohdaten und modernsten KI-Modellen und tragen direkt zur Verbesserung kritischer Trainingsmetriken wie Durchsatz und Beschleunigerauslastung bei. Ihre Arbeit wird entscheidend für Cohere’s Mission sein, effiziente und zuverlässige Sprachverständnis- und Generierungsfähigkeiten bereitzustellen und Innovationen im Bereich der natürlichen Sprachverarbeitung voranzutreiben.

Wenn Sie leidenschaftlich daran interessiert sind, Daten in die Grundlage von KI-Systemen zu verwandeln, bietet Ihnen diese Rolle eine einzigartige Gelegenheit, einen bedeutenden Einfluss auszuüben.

Bitte beachten Sie: Wir haben Büros in London, Paris, Toronto, San Francisco und New York, begrüßen jedoch auch eine remote-freundliche Arbeitsweise! Es gibt keine Einschränkungen, wo Sie für diese Rolle zwischen EST und EU ansässig sein können.

Als Mitglied des technischen Personals für synthetische Daten werden Sie:

  • Skalierbare Inferenzpipelines entwerfen und erstellen, die auf großen GPU-Clustern laufen.
  • Datenablations durchführen, um die Datenqualität zu bewerten und mit Datenmischungen zu experimentieren, um die Modellleistung zu verbessern.
  • Innovative Methoden zur Kuratierung synthetischer Daten erforschen und implementieren, wobei Sie Cohere’s Infrastruktur nutzen, um Fortschritte in der natürlichen Sprachverarbeitung voranzutreiben.
  • Mit funktionsübergreifenden Teams, einschließlich Forschern und Ingenieuren, zusammenarbeiten, um sicherzustellen, dass die Datenpipelines den Anforderungen modernster Sprachmodelle entsprechen.

Sie könnten gut passen, wenn Sie:

  • Starke Software-Engineering-Fähigkeiten besitzen, mit Fachkenntnissen in Python und Erfahrung im Aufbau von Datenpipelines.
  • Vertrautheit mit Datenverarbeitungsframeworks wie Apache Spark, Apache Beam, Pandas oder ähnlichen Tools haben.
  • Erfahrung mit LLMs durch Arbeitsprojekte, Open-Source-Beiträge oder persönliche Experimente haben.
  • Vertrautheit mit LLM-Inferenz-Frameworks wie vLLM und TensorRT haben.
  • Erfahrung mit großangelegten Datensätzen, einschließlich Webdaten, Codierungsdaten und mehrsprachigen Korpora, haben.
  • Eine Leidenschaft dafür haben, Forschung und Ingenieurwesen zu verbinden, um komplexe datenbezogene Herausforderungen im Training von KI-Modellen zu lösen.

Bonus: Veröffentlichung in erstklassigen Fachzeitschriften (wie NeurIPS, ICML, ICLR, AIStats, MLSys, JMLR, AAAI, Nature, COLING, ACL, EMNLP).

Wenn einige der oben genannten Punkte nicht perfekt mit Ihrer Erfahrung übereinstimmen, ermutigen wir Sie dennoch, sich zu bewerben! Wir schätzen und feiern Vielfalt und bemühen uns, ein integratives Arbeitsumfeld für alle zu schaffen. Wir heißen Bewerber aus allen Hintergründen willkommen und setzen uns dafür ein, Chancengleichheit zu bieten. Sollten Sie während des Rekrutierungsprozesses Unterstützung benötigen, reichen Sie bitte ein Anfrageformular für Unterkünfte ein, und wir werden gemeinsam daran arbeiten, Ihre Bedürfnisse zu erfüllen.

Vollzeitmitarbeiter bei Cohere genießen diese Vorteile:

  • Eine offene und inklusive Kultur und Arbeitsumgebung
  • Enger Kontakt mit einem Team an der Spitze der KI-Forschung
  • Wöchentlicher Mittagszuschuss, Mittagessen und Snacks im Büro
  • Umfassende Gesundheits- und Zahnleistungen, einschließlich eines separaten Budgets für Ihre psychische Gesundheit
  • 100% Elternzeit-Zuschuss für bis zu 6 Monate
  • Persönliche Bereicherungsleistungen für Kunst und Kultur, Fitness und Wohlbefinden, Qualitätszeit und Arbeitsplatzverbesserung
  • Remote-flexibel, Büros in Toronto, New York, San Francisco, London und Paris sowie ein Co-Working-Zuschuss
  • 6 Wochen Urlaub (30 Arbeitstage!)

Member of Technical Staff, Synthetic Data Arbeitgeber: Cohere

Cohere ist ein hervorragender Arbeitgeber, der seinen Mitarbeitern die Möglichkeit bietet, an der Spitze der KI-Technologie zu arbeiten und dabei einen echten Einfluss auf die Geschäftswelt zu haben. Mit einem starken Fokus auf Mitarbeiterwohlbefinden, einschließlich großzügiger Urlaubsregelungen, umfassender Gesundheitsleistungen und individueller Weiterbildungsmöglichkeiten, fördert Cohere eine inklusive und dynamische Arbeitskultur, die Kreativität und Innovation schätzt. Die internationale Präsenz in Städten wie London und Paris ermöglicht es den Mitarbeitern, in einem vielfältigen Umfeld zu arbeiten und von den besten Talenten weltweit zu lernen.

C

Kontaktdaten:

Cohere Recruiting-Team

StudySmarter Expertenrat🤫

Wir sind der Meinung, dass du so Member of Technical Staff, Synthetic Data erhalten könntest

Wende dich an die richtigen Communities

Schau dir Online-Communities und Foren an, die sich um Data Science drehen, wie Kaggle oder GitHub. Engagiere dich dort aktiv, teile deine Projekte und lerne von anderen – das wird dir helfen, nicht nur einen Fuß in die Tür zu bekommen, sondern auch wertvolle Kontakte zu knüpfen.

Präsentiere deine Daten-Projekte

Baue ein Portfolio auf, das deine besten Projekte zeigt. Nutze Plattformen wie GitHub oder eine persönliche Webseite, um deine Arbeiten zu veröffentlichen. Arbeitgeber im Data Science-Bereich schauen oft direkt auf praktische Erfahrungen, also zeig, was du drauf hast!

Nimm an Meetups und Hackathons teil

Besuche lokale Data Science-Meetups oder nehme an Hackathons teil. Diese Veranstaltungen sind nicht nur super, um dein Wissen zu erweitern, sondern auch Gold wert für Networking. Du lernst Fachkollegen kennen und kannst auf Lockere Art und Weise Eventualjobs ergattern.

Direkte Bewerbungen über unsere Seite

Vergiss nicht, direkt auf unserer Website nach Stellenangeboten bei Cohere zu schauen. Hier kannst du dich auf offene Datenwissenschaftsstellen bewerben und zeigst damit direktes Interesse, das viele Arbeitgeber schätzen!

Wir glauben, dass du diese Fähigkeiten brauchst, um Member of Technical Staff, Synthetic Data mit Bravour zu bestehen

Software Engineering Skills
Python
Datenpipelines
Apache Spark
Apache Beam
Pandas
LLMs (Large Language Models)

Einige Tipps für deine Bewerbung 🫡

Lass deine Daten sprechen!:In einem Bereich wie Data Science ist es entscheidend, dass du deine praktischen Fähigkeiten präsentierst. Wenn du an Projekten gearbeitet hast, die deine Analysefähigkeiten oder dein Wissen über Machine Learning demonstrieren, teile sie in deinem Lebenslauf oder füge einen Link zu deinem GitHub-Portfolio bei. Die Daten, die du analysiert hast, und die Tools, die du verwendest, sollten klar hervorgehoben werden.

Ergebnisse quantifizieren!:Unterstütze deine Erfahrung mit quantifizierbaren Ergebnissen. Zeige, wie du durch deine Analysen oder Modelle zur Entscheidungsfindung beigetragen hast oder wie deine Berechnungen den Rohdaten neue Erkenntnisse entlockt haben. Arbeitgeber in der Data Science sind oft an konkreten Verbesserungen und Effizienzsteigerungen interessiert!

Erläutere deine Lernbereitschaft!:Da es sich um eine Vollzeitstelle handelt, zeige in deinem Anschreiben, dass du bereit bist, zu lernen und dich weiterzuentwickeln. Sprich über deine Neugier für neue Technologien oder Methoden im Data Science Bereich. Vielleicht hast du auch Kurse besucht oder Zertifikate erworben, die deine Begeisterung zeigen!

Die richtige technische Sprache!:Achte darauf, dass deine Bewerbung alle relevanten technischen Begriffe enthält, die in der Data Science gebräuchlich sind. Nenne spezifische Programmier- und Analysetools wie Python, R oder SQL, die du beherrschst. Dies macht es für die Rekrutierer einfacher, schnell zu erkennen, dass du für die Rolle als Member of Technical Staff, Synthetic Data bei Cohere gut geeignet bist.

Wie man sich auf ein Vorstellungsgespräch bei Cohere vorbereitet

Bereite deine technischen Skills vor

In einem Vorstellungsgespräch für eine Data-Science-Position wird oft dein Wissen über Tools wie Python, R oder SQL getestet. Mach dich mit gängigen Algorithmen und deren Einsatzmöglichkeiten vertraut, denn technische Fragen können schnell kommen. Lass uns sicherstellen, dass du in diesen Bereichen glänzt!

Verschaffe dir einen Überblick über Projekte

Da es sich um eine Vollzeitstelle handelt, ist es wichtig, dass du konkrete Erfahrungen und Projekte vorweisen kannst. Wenn du bereits an Data-Science-Projekten gearbeitet hast, sei bereit, diese in der Tiefe zu erläutern und zu diskutieren, wie du die Probleme gelöst hast. Dein Portfolio kann hier einen echten Unterschied machen!

Vorbereitung auf case studies

In Data-Science-Interviews sind case studies und praktische Probleme häufig Teil des Gesprächs. Übe, wie du strukturiert und logisch an solche Aufgaben herangehst. Arbeitgeber möchten sehen, wie du Daten analysierst und Lösungen entwickelst – bring also deine analytischen Fähigkeiten mit!

Zeige deine Leidenschaft für Daten

Mehr denn je geht es bei einer Vollzeitstelle darum, dass du nicht nur die Skills hast, sondern auch wirklich für das Feld brennst. Teile Anekdoten oder Erfahrungen, die zeigen, wie du zur Datenwissenschaft gekommen bist und was dich fasziniert. Diese Begeisterung kann für Cohere entscheidend sein!