Senior Frontier AI Safety Red Team Leader

Senior Frontier AI Safety Red Team Leader

Wien Vollzeit 72000 - 88000 € / Jahr (geschätzt) Kein Homeoffice möglich
M

Auf einen Blick

  • Aufgaben: Identifiziere Schwachstellen in fortschrittlichen KI-Systemen durch adversarielle Tests.
  • Unternehmen: Mercor, ein innovatives Unternehmen im Bereich KI-Sicherheit.
  • Vorteile: Attraktives Gehalt, flexible Arbeitszeiten und Weiterbildungsmöglichkeiten.
  • Weitere Informationen: Dynamisches Team mit großartigen Entwicklungsmöglichkeiten.
  • Warum dieser Job: Gestalte die Zukunft der KI-Sicherheit und mache einen echten Unterschied.
  • Qualifikationen: Erfahrung in KI-Sicherheit und Kenntnisse in adversarial testing.

Das prognostizierte Gehalt liegt zwischen 72000 - 88000 € pro Jahr.

Mercor seeks experienced AI Safety Red Teamers to identify vulnerabilities in frontier AI systems through adversarial testing.

You will design challenging prompts, uncover model weaknesses, and evaluate AI behavior across high-risk topics.

Responsibilities include stressing frontier models with adversarial prompts, identifying jailbreaks and policy failures, and documenting vulnerabilities for safety benchmarks and red-teaming reports.

#J-18808-Ljbffr

Senior Frontier AI Safety Red Team Leader Arbeitgeber: Mercor

Mercor ist ein hervorragender Arbeitgeber, der innovative Technologien und eine dynamische Arbeitsumgebung bietet. Mit einem Fokus auf Remote-Arbeit ermöglicht das Unternehmen seinen Mitarbeitern, flexibel zu arbeiten und gleichzeitig an spannenden Projekten im Bereich AI-gestützter DevOps und SRE teilzunehmen. Die Unternehmenskultur fördert kontinuierliches Lernen und persönliche Entwicklung, während die wettbewerbsfähige Vergütung von 85 $ pro Stunde die Wertschätzung für die Fähigkeiten und das Engagement der Mitarbeiter widerspiegelt.

M

Kontaktdaten:

Mercor Recruiting-Team

Wir glauben, dass du diese Fähigkeiten brauchst, um Senior Frontier AI Safety Red Team Leader mit Bravour zu bestehen

Erfahrung in adversarial Testing
Entwicklung herausfordernder Prompts
Identifikation von Schwachstellen in Modellen
Bewertung des Verhaltens von KI-Systemen
Dokumentation von Sicherheitsanforderungen
Kenntnisse über Jailbreaks und Richtlinienfehler
Fähigkeit zur Analyse von Hochrisikothemen