Senior Platform & Reliability Engineer

Senior Platform & Reliability Engineer

Vollzeit 63000 - 77000 € / Jahr (geschätzt) Homeoffice (teilweise)
O

Auf einen Blick

  • Aufgaben: Gestalte und verbessere die Zuverlässigkeit unserer Infrastruktur in einem dynamischen, KI-nativen Umfeld.
  • Unternehmen: OpenArt, eine innovative Plattform für KI-gestützte Geschichtenerstellung und visuelle Kreation.
  • Vorteile: Wettbewerbsfähiges Gehalt, Bonusprogramm und bedeutender Eigenanteil an dem, was du baust.
  • Weitere Informationen: Hohe Autonomie und Wachstumschancen in einem schnelllebigen Startup-Umfeld.
  • Warum dieser Job: Arbeite an spannenden Projekten mit echter Wirkung für Millionen von Nutzern.
  • Qualifikationen: Mindestens 5 Jahre Erfahrung in der Entwicklung und dem Betrieb von Produktionssystemen.

Das prognostizierte Gehalt liegt zwischen 63000 - 77000 € pro Jahr.

Über OpenArt
OpenArt ist eine KI-Storytelling- und visuelle Kreativplattform, die von Millionen weltweit genutzt wird. Wir entwickeln die nächste Generation kreativer Werkzeuge, die von modernster KI unterstützt werden, um es jedem zu ermöglichen, Videos, Visuals, Charaktere und Geschichten mit beispielloser Geschwindigkeit und Vorstellungskraft zu erstellen. Wir glauben, dass die Zukunft der Kreativität KI-nativ ist, und wir gestalten diese Zukunft.

Warum OpenArt beitreten?
Kleines Team, große Reichweite, erfahrene Ingenieure besitzen echte Systeme, nicht nur Teilbereiche. Arbeiten Sie in echtem Maßstab, Ihre Arbeit erreicht Millionen von Nutzern schnell. Gründergeführte Ingenieurskultur, beide Gründer sind technisch versiert und stark in Produkt und Architektur involviert. KI-natives Produkt, Sie gestalten, wie modernste KI-Modelle als echte Benutzererfahrungen präsentiert werden. Hohe Eigenverantwortung, wenig Prozesse, wir schätzen Urteilsvermögen, Klarheit und Geschwindigkeit über Bürokratie.

Über die Rolle
Wir suchen einen Senior Platform & Reliability Engineer, der hilft, unsere Infrastruktur zu entwerfen, zu skalieren und die Zuverlässigkeit zu verbessern, von architektonischen Entscheidungen bis hin zur praktischen Implementierung, Beobachtbarkeit und Kostenoptimierung. Dies ist keine traditionelle Ops- oder DevOps-Rolle. Sie arbeiten an Cloud-Infrastruktur, verteilten Systemen, Backend-Diensten und Entwicklerwerkzeugen und treffen pragmatische Entscheidungen, die Produktgeschwindigkeit, Systemzuverlässigkeit und Kosteneffizienz in einer sich schnell bewegenden, KI-nativen Umgebung ausbalancieren. Sie arbeiten eng mit Produktentwicklern zusammen, um die Plattform, die OpenArt antreibt, weiterzuentwickeln und zu wichtigen Entscheidungen über die Infrastrukturarchitektur beizutragen, die Zuverlässigkeit von Multi-Provider-KI zu verbessern und uns dabei zu helfen, Systeme für Millionen von Nutzern zu skalieren – während Sie das allgemeine Ingenieurniveau erhöhen.

Was Sie tun werden

  • Definieren und operationalisieren Sie SLOs/SLIs über kritische Benutzerreisen (Generierung, Bearbeitung, Zahlungen/Gutschriften, Uploads) und verwenden Sie diese zur Anleitung von Priorisierungen und Abwägungen.
  • Teilnahme an einer Bereitschaftsrotation und Verbesserung der Vorfallreaktion (Alarmqualität, Handbuch, Eskalationswege), einschließlich der Leitung von fehlerfreien Nachbesprechungen und der Verfolgung von Maßnahmen.
  • Verbessern Sie die Systemresilienz an externen Grenzen (KI-Anbieter, Speicherung usw.), einschließlich Timeouts, Wiederholungen, Schaltkreisschutz und Fallback-Strategien.
  • Erstellen und pflegen Sie eine End-to-End-Beobachtbarkeit (Protokolle, Metriken, Traces, Dashboards), damit Ingenieure schnell verstehen können, „was kaputt ist“ und „warum“.
  • Stärken Sie die Bereitstellungssicherheit durch CI/CD-Verbesserungen, automatisierte Rollbacks, Canary-Releases und Feature-Flag-Muster.
  • Tragen Sie zur Weiterentwicklung unserer Infrastrukturarchitektur bei und helfen Sie zu bewerten, wann serverlose Muster erweitert oder containerisierte oder stärker verwaltete Ansätze übernommen werden sollen, während wir skalieren.
  • Verbessern Sie die Kostenübersicht und -effizienz, einschließlich der Kostenattribution pro Anfrage, Caching-Strategien und Kapazitätsplanung.
  • Handeln Sie als starker technischer Mitwirkender, der hilft, Ingenieurpraktiken, Werkzeuge und Systemdesignentscheidungen im gesamten Team zu verbessern.

Was wir suchen

  • Mindestens 5 Jahre Erfahrung im Aufbau und Betrieb von Produktionssystemen, bei denen Zuverlässigkeit und Skalierung wichtig sind.
  • Starke Software-Engineering-Fähigkeiten – Sie können Produktionscode erstellen und bereitstellen, nicht nur Infrastruktur konfigurieren.
  • Erfahrung mit cloud-nativen Systemen (AWS oder GCP), einschließlich serverloser/ereignisgesteuerter Architekturen und mindestens einem containerbasierten Ansatz (z. B. ECS/Fargate, Cloud Run, Kubernetes).
  • Solides Verständnis von Beobachtungs- und Zuverlässigkeitspraktiken: Metriken, Alarmierung, Nachverfolgung und Vorfallreaktion.
  • Erfahrung im Entwerfen robuster Systeme mit externen Abhängigkeiten (Timeouts, Wiederholungen/Rückstau, Idempotenz, Schaltkreisschutz).
  • Fähigkeit, technische Abwägungen klar an Ingenieure in verschiedenen Bereichen zu kommunizieren.
  • Komfortabel im Umgang mit unklaren, sich schnell bewegenden Umgebungen und Übernahme von Verantwortung für Probleme.
  • Erfahrung im Aufbau interner Plattformabstraktionen (z. B. Job-Orchestrierung, API-Schichten, Workflow-Systeme), die die Teamgeschwindigkeit verbessern.
  • Nachweisliche Erfolge bei der Verbesserung von Zuverlässigkeitsmetriken (z. B. MTTR, SLO-Erreichung, Latenz) oder der Reduzierung von Infrastrukturkosten.
  • Erfahrung in einem Startup oder einer schnell wachsenden Umgebung mit breiter Verantwortung über Systeme.

Technologiestack, mit dem Sie arbeiten werden
GCP, Cloud Run, Modal, Upstash, Sentry, Amplitude, Firebase, Redis, React/Next.js, Node.js, TypeScript, Python usw.

Vergütung
Wettbewerbsfähiges Grundgehalt und Bonusprogramm. Equity - bedeutende Beteiligung an dem, was Sie aufbauen. Hohe Autonomie, wachstumsorientierte Umgebung.

Arbeitssetup
Bay Area bevorzugt (Hybrid erlaubt). Visumsponsoring verfügbar. Wir ziehen Remote-Arbeit in Betracht.

Senior Platform & Reliability Engineer Arbeitgeber: OpenArt AI

OpenArt ist ein hervorragender Arbeitgeber, der eine dynamische und innovative Arbeitsumgebung bietet, in der Senior Platform & Reliability Engineers die Möglichkeit haben, an einem AI-nativen Produkt zu arbeiten, das von Millionen weltweit genutzt wird. Mit einer Gründer-geführten Ingenieurskultur, hoher Eigenverantwortung und der Chance, in einem schnell wachsenden Unternehmen mit 17-10X Umsatzwachstum zu arbeiten, fördert OpenArt nicht nur die persönliche und berufliche Weiterentwicklung, sondern bietet auch wettbewerbsfähige Gehälter und Beteiligungsmöglichkeiten.

O

Kontaktdaten:

OpenArt AI Recruiting-Team

StudySmarter Expertenrat🤫

Wir sind der Meinung, dass du so Senior Platform & Reliability Engineer erhalten könntest

Netzwerken in der IT-Community

In der IT-Consulting-Welt sollten wir regelmäßig auf Veranstaltungen wie Tech-Meetups oder Konferenzen gehen. Hier können wir nicht nur unser Netzwerk erweitern, sondern auch direkt mit potenziellen Arbeitgebern ins Gespräch kommen und unser Interesse an einer Vollzeitstelle zeigen.

Online-Foren und Gruppen nutzen

Sich in Online-Foren und Communities wie Stack Overflow oder LinkedIn-Gruppen umzusehen, kann uns helfen, Insider-Tipps zu erhalten und Informationen über offene Stellen in der IT-Beratung zu sammeln. Vergiss nicht, aktiv zu werden und Fragen zu stellen oder dein Wissen zu teilen – das erhöht unsere Sichtbarkeit!

Direkt bei OpenArt AI bewerben

Viele Unternehmen, wie OpenArt AI, stemmen ihre Vollzeitstellen bevorzugt über ihre eigenen Karriere-Webseiten. Also, lass uns regelmäßig auf deren Seite vorbeischauen und uns direkt bewerben, statt nur die üblichen Jobportale zu nutzen.

Überzeugende Projekte zeigen

Wir sollten unser Portfolio oder relevante Projekte gut sichtbar machen, egal ob das auf Github, persönlich oder auf LinkedIn ist. Bei IT-Consulting-Stellen kommt es oft auf praktische Erfahrungen an, also lass uns zeigen, was wir können!

Wir glauben, dass du diese Fähigkeiten brauchst, um Senior Platform & Reliability Engineer mit Bravour zu bestehen

Cloud-native Systeme (AWS oder GCP)
Serverless/Event-Driven Architekturen
Container-basierte Ansätze (z.B. ECS/Fargate, Cloud Run, Kubernetes)
Software Engineering Fähigkeiten
Beobachtbarkeit und Zuverlässigkeitspraktiken
Design resilienter Systeme mit externen Abhängigkeiten
Technische Trade-offs kommunizieren

Einige Tipps für deine Bewerbung 🫡

Zeige deine technischen Skills!:In der IT-Beratung zählen deine technischen Kenntnisse und Fähigkeiten. Achte darauf, relevante Programmiersprachen, Tools und Systeme in deinem Lebenslauf aufzulisten. Zeig auch, wenn du Zertifikate hast, die deine Kompetenz unterstützen – das könnte dir einen echten Vorteil verschaffen!

Verstehe die Branche!:Unterstreiche in deinem Anschreiben, dass du ein gutes Verständnis für aktuelle Trends und Herausforderungen in der IT-Branche hast. Zeig, dass du nicht nur die technischen Aspekte beherrschst, sondern auch die Bedürfnisse der Kunden erkennen und lösen kannst!

Deine Projekte zählen!:Falls du bereits an IT-Projekten gearbeitet hast, verlinke diese oder beschreibe sie in deinem Lebenslauf. Praktische Erfahrungen – sei es in Form von Praktika oder privaten Projekten – sind besonders wertvoll in der IT-Beratung. Zeige uns, was du kannst!

Individuelle Bewerbung ist der Schlüssel!:Jede Bewerbung sollte individuell auf OpenArt AI und die ausgeschriebene Position Senior Platform & Reliability Engineer zugeschnitten sein. Teile uns mit, warum gerade du eine gute Wahl für unser Team bist. Das zeigt dein Engagement und deine Motivation, die über eine Standardbewerbung hinausgeht.

Wie man sich auf ein Vorstellungsgespräch bei OpenArt AI vorbereitet

Technische Vorbereitung ist alles!

Da du dich auf eine Vollzeitstelle in der IT-Beratung bewirbst, solltest du dir wirklich einen Überblick über die wichtigsten Tools und Technologien verschaffen, die in der Branche verwendet werden. Sei bereit, technische Fragen zu beantworten, die sich auf Software-Architektur oder Systemintegration beziehen könnten.

Praxisbeispiele parat haben

In der IT-Beratung ist es wichtig, konkrete Beispiele aus deiner bisherigen Erfahrung zu bringen. Überlege dir Projekte, bei denen du erfolgreich einen Kunden beraten hast oder Herausforderungen gelöst hast. Das zeigt, dass du nicht nur theoretisches Wissen hast, sondern auch in der Praxis erfolgreich sein kannst.

Soft Skills betonen

Ein großer Teil der IT-Beratung ist die Kommunikation mit Kunden und das Verständnis ihrer Bedürfnisse. Bereite dich darauf vor, über deine zwischenmenschlichen Fähigkeiten zu sprechen, wie du mit herausfordernden Kunden umgehst oder wie du in Teams arbeitest. Das wird den Interviewern zeigen, dass du mehr als nur technisches Wissen mitbringst!

Fragen zum Unternehmen vorbereiten

Schau dir spezifisch die Projekte von OpenArt AI an und überlege dir, welche Fragen du dazu stellen möchtest. Zeig Interesse an den aktuellen Herausforderungen, vor denen das Unternehmen steht, und wie du dazu beitragen könntest. Das hebt dich von anderen Bewerbern ab und zeigt, dass du wirklich motiviert bist.