Auf einen Blick
- Aufgaben: Baue und pflege die Infrastruktur für visuelle Intelligenz und optimiere deren Leistung.
- Unternehmen: Innovatives Unternehmen mit Fokus auf Forschung und Entwicklung.
- Vorteile: Attraktives Gehalt, Aktienoptionen und flexible Arbeitsmodelle.
- Weitere Informationen: Dynamisches Team mit Möglichkeiten zur persönlichen und beruflichen Weiterentwicklung.
- Warum dieser Job: Gestalte die Zukunft der Technologie und arbeite an bahnbrechenden Projekten.
- Qualifikationen: Erfahrung mit großen Trainingsplattformen und verteilten Systemen.
Das prognostizierte Gehalt liegt zwischen 100000 - 230000 € pro Jahr.
Wir suchen Ingenieure, die die Engine aufbauen und warten, die unsere Mission zur Entwicklung visueller Intelligenz antreibt. Von der Wartung und Skalierung von Clustern bis hin zum Aufbau von Forschungsplattformen zur Beschleunigung des Innovationsprozesses, dieses Team arbeitet mit großer Breite und Tiefe. Wir bauen Systeme, die mehrwöchiges Training ermöglichen, Ressourcen in großem Maßstab orchestrieren und gleichzeitig effizient arbeiten, um das nächste bahnbrechende Modell zu ermöglichen. Wenn Sie sich für verteilte Systeme im großen Maßstab, Infrastrukturzuverlässigkeit, Skalierbarkeit, Sicherheit und kontinuierliche Verbesserung begeistern, wäre dieses Team perfekt für Sie.
Was Sie bearbeiten werden:
- Wartung der Forschungsinfrastruktur, Sicherstellung der Gesundheit und Optimierung von Komponenten zur Maximierung der Systemleistung (sowohl auf Anwendungs- als auch auf Infrastrukturseite)
- Skalierung der Infrastruktur, um den wachsenden Forschungsanforderungen gerecht zu werden, während Zuverlässigkeit und Leistung aufrechterhalten werden
- Zusammenarbeit mit Forschungsteams, um ihre Infrastrukturbedürfnisse tiefgehend zu verstehen und Lösungen zu entwerfen, die Leistung und Kosteneffizienz ausbalancieren
- Identifizierung und Behebung von Leistungsengpässen und Kapazitäts-Hotspots durch tiefgehende Analyse verteilter Systeme im großen Maßstab
- Aufbau und Weiterentwicklung von Telemetrie- und Überwachungssystemen, um tiefe Einblicke in die Infrastrukturleistung, -nutzung und -kosten über unsere Cloud- und Rechenzentrumsflotten zu bieten
- Teilnahme an Bereitschaftsdiensten und Vorfallreaktionen zur Aufrechterhaltung der Systemzuverlässigkeit
Technischer Fokus:
- Python, Bash, Go
- Kubernetes
- Nvidia GPU-Treiber und -Operatoren
- OTel, Prometheus
Was wir suchen:
- Erfahrung im Aufbau oder Betrieb von groß angelegten Trainingsplattformen
- Arbeit mit großen Rechenclustern (GPUs)
- Nachgewiesene Fähigkeit zur Fehlersuche bei Leistungs- und Zuverlässigkeitsproblemen über große verteilte Flotten
- Starke Problemlösungsfähigkeiten und die Fähigkeit, unabhängig zu arbeiten
- Starke Kommunikationsfähigkeiten und die Fähigkeit, effektiv mit internen und externen Partnern zusammenzuarbeiten
- Tiefes Wissen über moderne Cloud-Infrastruktur einschließlich Kubernetes, Infrastructure as Code, AWS und GCP
- Erfahrung mit SLURM
Wie wir zusammenarbeiten:
Wir sind ein verteiltes Team mit echten Büros, die die Menschen tatsächlich nutzen. Je nach Rolle werden Sie entweder mindestens 2 Tage pro Woche (oder eine volle Woche alle zwei Wochen) in Freiburg oder SF bei uns sein oder remote arbeiten mit einer monatlichen persönlichen Woche, um verbunden zu bleiben. Wir übernehmen angemessene Reisekosten, um dies zu ermöglichen. Wir denken, dass persönliche Zeit wichtig ist, und haben die Dinge so strukturiert, dass sie für alle zugänglich sind. Wir werden besprechen, wie dies für die Rolle während unseres Interviewprozesses aussehen wird.
Jahresgrundgehalt: EU €100.000 - €230.000 + Eigenkapital; US $150.000 - $300.000 + Eigenkapital. Diese Rolle basiert in unserem Büro in Freiburg / San Francisco. Wir betreiben ein hybrides Modell und übernehmen angemessene Reisekosten – eine Umsiedlung wird empfohlen, aber nicht erforderlich. Wir erwarten eine bedeutende persönliche Präsenz und werden besprechen, wie das für Ihre Situation während des Prozesses aussieht.
Member of Technical Staff - Research Infrastructure Engineer Arbeitgeber: Black Forest Labs
Black Forest Labs ist ein hervorragender Arbeitgeber, der seinen Mitarbeitern die Möglichkeit bietet, an der Spitze der generativen KI-Technologie zu arbeiten. Mit einem inspirierenden Arbeitsumfeld in Freiburg, das Forschungsexzellenz und offene Wissenschaft fördert, profitieren Mitarbeiter von flexiblen Arbeitsmodellen, regelmäßigen persönlichen Treffen und einer Kultur, die Kreativität und Zusammenarbeit schätzt. Zudem gibt es zahlreiche Wachstums- und Entwicklungsmöglichkeiten, um die Karriere voranzutreiben und Teil eines dynamischen Teams zu sein, das die Zukunft der Bild- und Videoproduktion gestaltet.