Auf einen Blick
- Aufgaben: Verwalte Cloud-Infrastruktur und sorge für optimale Leistung und Kostenkontrolle.
- Unternehmen: Langfuse, ein innovatives Unternehmen im Bereich Cloud-Technologie.
- Vorteile: Flexibles Arbeitsumfeld, Gesundheitsleistungen, Aktienoptionen und großzügige Urlaubsregelungen.
- Weitere Informationen: Wachstumsorientierte Kultur mit Möglichkeiten zur Mitgestaltung.
- Warum dieser Job: Gestalte die Infrastruktur eines schnell wachsenden Unternehmens und arbeite mit modernster Technologie.
- Qualifikationen: Erfahrung in der Cloud-Administration und Begeisterung für Automatisierung.
Das prognostizierte Gehalt liegt zwischen 56250 - 68750 € pro Jahr.
Warum Cloud-Infrastruktur bei Langfuse
Ihre Arbeit wird Langfuse überall am Laufen halten. Langfuse verarbeitet über eine Milliarde Trace-Events pro Monat. Wenn ein Fortune-50-Unternehmen auf Langfuse in der Produktion angewiesen ist, verlassen sie sich auf die Infrastruktur, die Sie betreiben. Sie sind verantwortlich für Uptime, Leistung und Kosteneffizienz über unsere gesamte Cloud-Präsenz hinweg – und Sie stellen sicher, dass jede selbst gehostete Bereitstellung reibungslos läuft.
Sie betreiben Langfuse Cloud auf AWS ECS Fargate und ClickHouse Cloud, mit Datadog als Rückgrat der Beobachtbarkeit. Sie sind auch für unsere öffentliche selbst gehostete Infrastruktur verantwortlich – einschließlich unseres Helm-Charts, Docker Compose-Setups und allem dazwischen – damit Teams von Startups bis hin zu Unternehmen Langfuse nach ihren eigenen Vorstellungen betreiben können. Dies ist keine Rolle, in der man nur das Bestehende wartet. Wir wachsen schnell, und Sie werden die Person sein, die sicherstellt, dass die Infrastruktur vor der Nachfrage wächst – nicht dahinter.
Langfuse ist jetzt Teil von ClickHouse, was bedeutet, dass das Team hinter der Datenbank, die den Kern unseres Stacks bildet, nur einen Kanal entfernt ist. Wenige Infrastrukturrollen geben Ihnen so direkten Zugang zu den Menschen, die Ihre kritischste Abhängigkeit aufbauen.
Sie werden bei Langfuse wachsen durch:
- Eigentum an Langfuse Cloud-Operationen: Sie betreiben unsere Produktionsumgebungen auf AWS ECS Fargate und ClickHouse Cloud. Sie verwalten Bereitstellungen, Autoskalierung, Kapazitätsplanung und Kostenoptimierung – und stellen sicher, dass wir schnell und erschwinglich bleiben, während der Verkehr steigt.
- Weltklasse-Beobachtbarkeit aufbauen: Sie sind verantwortlich für unser Datadog-Setup von Anfang bis Ende – Dashboards, Alarme und SLOs. Wenn etwas nachlässt, stellen Sie sicher, dass wir es wissen, bevor unsere Kunden es tun. Sie werden die Überwachungskultur aufbauen, die es dem gesamten Team ermöglicht, mit Vertrauen zu liefern.
- Selbsthosting mühelos machen: Tausende von Teams betreiben Langfuse auf ihrer eigenen Infrastruktur. Sie sind verantwortlich für die Weiterentwicklung unseres Helm-Charts, der Docker Compose-Konfiguration und der Bereitstellungsdokumentation. Sie verwandeln "funktioniert auf meinem Rechner" in "funktioniert auf jedem Rechner" – von einer Einzelknoten-Bereitstellung bis hin zu einer Multi-Region-Unternehmensbereitstellung.
- Alles automatisieren: CI/CD-Pipelines, Infrastruktur als Code, automatisierte Skalierung, Zero-Downtime-Bereitstellungen. Sie ersetzen manuelle Prozesse durch Automatisierung, die das Team schneller und die Plattform zuverlässiger macht.
- Für das nächste Wachstum skalieren: Wir wachsen schnell und neue Produktrichtungen – wie komplexe, langlaufende Agentenbeobachtbarkeit und Echtzeitevaluierung – treiben die Infrastruktur auf neue Weise voran. Sie denken voraus, was bei 10-facher Skalierung kaputt geht, und bauen die Grundlage, bevor wir dort ankommen. 10x ist hier bei Langfuse immer nur ein Quartal entfernt.
- Sicherheit und Compliance stärken: Da immer mehr Unternehmen Langfuse übernehmen, helfen Sie sicherzustellen, dass unsere Cloud- und selbst gehosteten Bereitstellungen die Sicherheits- und Compliance-Anforderungen großer Organisationen erfüllen.
Was wir suchen:
- Starker Infrastruktur- oder SRE-Ingenieur, der begeistert ist, Systeme in großem Maßstab zu betreiben und sie jeden Tag besser zu machen.
- Erfahrung im Betrieb von Produktionslasten auf AWS (ECS/Fargate, Netzwerk, IAM, S3 usw.) oder bei vergleichbaren Hyperscale-Anbietern.
- Vertrautheit mit Container-Orchestrierung – Kubernetes und/oder ECS, Helm-Charts, Docker.
- Erfahrung mit Infrastruktur als Code (Terraform, Pulumi, CloudFormation oder ähnliches).
- Starke Überwachungs- und Beobachtungsinstinkte – Sie haben Dashboards und Alarme erstellt, die tatsächlich Probleme erkannt haben (Erfahrung mit Datadog ist von Vorteil).
- Sie organisieren sich selbst. Sie haben starke Meinungen über Zuverlässigkeit, Automatisierung und wie man Infrastrukturänderungen sicher bereitstellt.
- Interesse an Open-Source-Software und echte Freude daran, Benutzern zu helfen, ihre selbst gehosteten Bereitstellungen zu debuggen.
- Blühen in einem kleinen, verantwortlichen Team, in dem Ihre Ergebnisse sichtbar sind und zählen.
- Bevorzugter Abschluss in Informatik oder einem quantitativen Fach.
- Bonuspunkte: Erfahrung mit ClickHouse Cloud oder anderen verwalteten analytischen Datenbanken, Hintergrund im Betrieb von Hochdurchsatz-Ereignisverarbeitung oder Beobachtungsinfrastruktur, Beiträge zu Open-Source-Infrastruktur-Tools (Helm-Charts, Terraform-Module usw.), ehemaliger Gründer.
Vorteile:
- Flexibles Arbeitsumfeld - ClickHouse ist ein global verteiltes Unternehmen und remote-freundlich. Wir sind derzeit in über 25 Ländern tätig.
- Gesundheitsversorgung - Arbeitgeberbeiträge zu Ihrer Gesundheitsversorgung.
- Eigenkapital im Unternehmen - Jedes neue Teammitglied, das unserem Unternehmen beitritt, erhält Aktienoptionen.
- Urlaub - Flexibler Urlaub in den USA, großzügige Ansprüche in anderen Ländern.
- Ein USD$500 Homeoffice-Setup, wenn Sie ein Remote-Mitarbeiter sind.
- Globale Zusammenkünfte – Wir glauben an die Kraft der persönlichen Verbindung und bieten Möglichkeiten, mit Kollegen bei unternehmensweiten Offsites in Kontakt zu treten.
- Kultur - Wir alle gestalten sie. Als Teil eines schnell wachsenden Start-ups werden Sie entscheidend dazu beitragen, unsere Kultur zu formen.
Gleichberechtigung & Datenschutz: ClickHouse bietet allen Mitarbeitern und Bewerbern gleiche Beschäftigungsmöglichkeiten und verbietet Diskriminierung und Belästigung jeglicher Art aufgrund von Faktoren wie Rasse, Hautfarbe, Religion, Alter, Geschlecht, nationaler Herkunft, Behinderungsstatus, genetischer Merkmale, geschütztem Veteranenstatus, sexueller Orientierung, Geschlechtsidentität oder -ausdruck oder einer anderen durch Bundes-, Landes- oder lokale Gesetze geschützten Eigenschaft.
Langfuse - Senior Cloud Infra Engineer Arbeitgeber: ClickHouse
Langfuse bietet eine dynamische und flexible Arbeitsumgebung, in der Sie als Senior Cloud Infra Engineer eine Schlüsselrolle in einem schnell wachsenden Unternehmen spielen. Mit einem starken Fokus auf Mitarbeiterentwicklung und einer Kultur, die Innovation und Zusammenarbeit fördert, haben Sie die Möglichkeit, Ihre Fähigkeiten in der Cloud-Infrastruktur zu erweitern und aktiv zur Gestaltung der Unternehmenskultur beizutragen. Zudem profitieren Sie von attraktiven Vorteilen wie flexiblen Arbeitszeiten, Gesundheitsleistungen und Aktienoptionen, während Sie Teil eines globalen Teams sind, das in über 25 Ländern tätig ist.