Site Reliability Engineer (f/m/d) – Observability & Internal Tools

Site Reliability Engineer (f/m/d) – Observability & Internal Tools

Berlin Vollzeit 55000 - 70000 € / Jahr (geschätzt) Homeoffice möglich
S

Auf einen Blick

  • Aufgaben: Übernimm die Verantwortung für interne Tools und entwickle unsere Observability-Strategien.
  • Unternehmen: Innovatives Unternehmen mit flexibler Remote-Arbeit und kreativer Kultur.
  • Vorteile: 30 Tage Urlaub, Smart Fridays, Gesundheitsangebote und mehr.
  • Weitere Informationen: Wachstumsmöglichkeiten durch Hackathons, Konferenzen und offene Zusammenarbeit.
  • Warum dieser Job: Gestalte die Zukunft der Softwareentwicklung und arbeite an spannenden Projekten.
  • Qualifikationen: Erfahrung in Systemdenken und technische Neugier sind ein Muss.

Das prognostizierte Gehalt liegt zwischen 55000 - 70000 € pro Jahr.

Remote in our day-to-day work. On-site, wenn es darauf ankommt. Wir arbeiten standardmäßig remote – fokussiert, effizient und mit voller Verantwortung. Für größere Funktionen, architektonische Entscheidungen und echte Brainstorming-Sitzungen kommen wir in Berlin oder Köln zusammen – schnell, praktisch und ohne unnötigen Meeting-Overhead.

Wir nutzen KI, um zu beschleunigen – nicht um das Denken zu ersetzen. Wir entwerfen das System, steuern die Ergebnisse und übernehmen Verantwortung für das, was wir ausliefern. Schnell, wo es sinnvoll ist. Sorgfältig, wo es wichtig ist.

Ihre Mission

Übernehmen Sie die volle Verantwortung für die internen Dienstprogramme und Plattform-Tools von smartclip. Konzentrieren Sie Ihre Energie auf die Schnittstelle von Beobachtbarkeit, Automatisierung und Entwicklerinfrastruktur. Pflegen Sie nicht nur bestehende Systeme – entwickeln Sie sie weiter, forschen Sie nach modernen Open-Source-Alternativen und setzen Sie diese um.

Vergessen Sie teure Enterprise-SaaS. Investieren Sie in tiefgehendes internes Fachwissen. Verstehen Sie unsere Systeme von Ende zu Ende, bewahren Sie totale Flexibilität und tragen Sie zum Open-Source-Ökosystem bei, von dem wir abhängen.

Stellen Sie sich diesen Herausforderungen:

  • Build & Evolve: Betreiben und verbessern Sie unseren Beobachtbarkeits-Stack (einschließlich Prometheus, Grafana und Forgejo).
  • Go Open Source First: Ersetzen Sie „Kauf“-Entscheidungen durch robuste „Bau- & Wartungs“-Strategien.
  • Engineer the Platform: Gestalten Sie Beobachtbarkeit als Plattformfähigkeit. Definieren Sie SLOs und erstellen Sie umsetzbare Alarme, um Vorfälle zu verhindern, bevor sie beginnen.
  • Secure the Stack: Integrieren Sie Sicherheitsengineering in den Lieferprozess. Finden Sie Schwachstellen, bevor die Pen-Tests dies tun.
  • Master the Infrastructure: Navigieren Sie durch Linux-Systeme und verteilte Tools. Balancieren Sie mutige Erkundung mit Produktionsstabilität.

Ihre Fähigkeiten

Seien Sie motiviert durch systemisches Denken und tiefes technisches Interesse. Hören Sie auf, Konsument zu sein – beginnen Sie, ein Builder zu sein.

Must-haves:

  • Wenden Sie eine Beobachtbarkeitsmentalität an: Implementieren Sie eine klare Strategie für Metriken, Protokolle und Traces. Verwandeln Sie „laute Alarme“ in „umsetzbare Erkenntnisse“.
  • Übernehmen Sie Verantwortung: Leben Sie die Philosophie „Sie bauen es, Sie betreiben es“. Beenden Sie das Ticket-Ping-Pong und die Ausreden.

Nice-to-haves:

  • Gestalten und entwickeln Sie produktionsreife Setups auf GCP oder AWS.
  • Zeigen Sie uns Ihre Beiträge zu Open-Source-Projekten.
  • Verwandeln Sie Ihre Leidenschaft für Ursachenanalysen in schuldlose Nachbesprechungen.

Warum Sie gerne mit uns arbeiten werden

  • Verantwortung über Tickets: Sie werden mit echter Verantwortung betraut, nicht nur mit Aufgaben. Keine unnötige Bürokratie, kein Mikromanagement – wir verlassen uns darauf, dass Sie die Dinge vorantreiben.
  • Build > Talk: Wir testen, was funktioniert – nicht, was gut klingt. Schnell scheitern, schneller lernen.
  • Hohe Standards, niedriges Ego: Wir nehmen unsere Arbeit ernst, aber uns selbst nicht. Direkte Rückmeldungen, ehrliche Zusammenarbeit, kein Drama.
  • Bleiben Sie scharf: Hackathons, Konferenzen, Community – wir investieren in Ihr Wachstum und halten Sie an der Spitze.
  • Remote-Flexibilität. Persönlich, wenn es darauf ankommt: Sie arbeiten flexibel remote, mit einer Verbindung zu unseren Standorten in Berlin oder Köln, wo sich unsere TV Labs befinden und wir gemeinsam experimentieren, bauen und lernen.

Und ja – die Grundlagen sind auch abgedeckt: 30 Tage Urlaub + 24. und 31. Dezember frei, Smart Fridays (4-Tage-Woche möglich), Mobilität (Deutschlandticket & JobRad), Sport- & Gesundheitsangebote, Unterstützung für psychische Gesundheit, Unternehmensleistungen, RTL+-Zugang und mehr.

Ihr Lebenslauf ist nur der Ausgangspunkt. Was uns mehr interessiert als Ihr Lebenslauf: ein Portfolio, ein Nebenprojekt, ein Demo-Repo – alles, was zeigt, dass Sie nicht nur über Code sprechen, sondern ihn auch liefern. Produktionsbereit. Durchdacht. Fertig.

smartclip setzt sich dafür ein, ein diverses und integratives Umfeld zu schaffen. Alle qualifizierten Bewerber werden unabhängig von Rasse, Ethnie, Nationalität, Alter, Geschlecht, Geschlechtsidentität, Religion, sexueller Orientierung, Behinderung oder anderen vielfältigen Merkmalen bei der Beschäftigung berücksichtigt.

Site Reliability Engineer (f/m/d) – Observability & Internal Tools Arbeitgeber: smartclip Europe

Als Senior Product Manager (f/m/d) – AI bei smartclip erwartet Sie eine dynamische und innovative Arbeitsumgebung, in der Sie die Verantwortung für die Produktvision übernehmen und an der Entwicklung bahnbrechender KI-Agentenprodukte mitwirken. Mit flexiblen Remote-Arbeitsmöglichkeiten und der Option, sich in unseren Büros in Berlin oder Köln zu treffen, fördern wir eine Kultur des Vertrauens, der Eigenverantwortung und des kontinuierlichen Lernens. Profitieren Sie von 30 Tagen Urlaub, Smart Fridays und zahlreichen Wachstumschancen, während Sie Teil eines Teams sind, das hohe Standards setzt und gleichzeitig eine offene, kollegiale Atmosphäre pflegt.

S

Kontaktdaten:

smartclip Europe Recruiting-Team

Wir glauben, dass du diese Fähigkeiten brauchst, um Site Reliability Engineer (f/m/d) – Observability & Internal Tools mit Bravour zu bestehen

Observability Mindset
Metrics, Logs und Traces
SLOs definieren
Actionable Alerting
Linux-Systeme
Verteilte Werkzeuge
GCP oder AWS