Auf einen Blick
- Aufgaben: Entwickle skalierbare Cloud-Lösungen und leite innovative AI-Projekte.
- Unternehmen: DigitalOcean, ein führendes Unternehmen im Cloud-Bereich mit einer dynamischen Kultur.
- Vorteile: Wettbewerbsfähiges Gehalt, Gesundheitsleistungen, flexible Arbeitszeiten und Weiterbildungsmöglichkeiten.
- Weitere Informationen: Wachstumsorientierte Umgebung mit großartigen Karrierechancen und einem Fokus auf Teamarbeit.
- Warum dieser Job: Gestalte die Zukunft der AI-Infrastruktur und arbeite mit den besten Talenten der Branche.
- Qualifikationen: Erfahrung in Softwareentwicklung, insbesondere mit AI-Frameworks und verteilten Systemen.
Das prognostizierte Gehalt liegt zwischen 60750 - 74250 € pro Jahr.
Tauchen Sie ein und leisten Sie die beste Arbeit Ihrer Karriere bei DigitalOcean. Begleiten Sie eine starke Gemeinschaft von Top-Talenten, die unermüdlich daran arbeiten, die einfachste skalierbare Cloud zu schaffen. Wenn Sie eine Wachstumsmentalität haben, gerne groß und mutig denken und von der schnelllebigen Umgebung eines echten Branchenveränderers begeistert sind, werden Sie hier Ihren Platz finden. Wir schätzen das gemeinsame Gewinnen - während wir lernen, Spaß haben und einen tiefgreifenden Unterschied für die Träumer und Macher in der Welt machen.
DigitalOcean erweitert seine KI-Infrastruktur, um die nächste Generation von KI-gesteuerten Anwendungen zu unterstützen. Wir suchen einen Senior Engineer 2, der unserem AI Inference Data Plane-Team beitritt. In dieser Rolle werden Sie ein wichtiger technischer Leiter sein, der für das Design, die Entwicklung und die Bereitstellung von hochskalierbaren, resilienten Datenplane-Diensten verantwortlich ist, die unser Angebot "Inference as a Service" antreiben.
Was Sie tun werden:
- Technische Führung: Agieren Sie als technischer Leiter im Team und treiben Sie das End-to-End-Design, die Entwicklung und die Lieferung kritischer Datenplane-Komponenten, die große generative KI-Modelle hosten.
- Systemdesign: Architektieren und verfeinern Sie Systemdesignvorschläge für unser hochskalierbares, mehrmandantenfähiges KI-Inferenz-Cloud-Ökosystem, um sicherzustellen, dass sie strengen Verfügbarkeits- und Resilienzstandards entsprechen.
- Leistungsoptimierung: Implementieren und optimieren Sie das Hosting verteilter Inferenz mit Techniken wie Tensor-/Datenparallelismus, KV-Cache-Optimierungen und intelligentem Routing.
- Zusammenarbeit: Arbeiten Sie funktionsübergreifend mit Produktmanagern, kundenorientierten Teams und anderen Ingenieurteams zusammen, um technische Fahrpläne mit den Kundenbedürfnissen in Einklang zu bringen.
- Verteiltes Servieren in großem Maßstab: Bauen Sie auf Kubernetes-nativen Frameworks für verteilte Inferenz wie llm-d (oder Alternativen wie NVIDIA Dynamo, Ray Serve) auf, um Prefill/Decode-Disaggregation, KV-Cache-bewusstes Routing, gestaffeltes Präfix-Caching und breite Expertenparallelität für MoE-Modelle bereitzustellen.
- Flusskontrolle & Lastenausgleich: Lösen Sie die einzigartigen Probleme verteilter Systeme beim LLM-Serving - inferenzbewusster Lastenausgleich basierend auf Warteschlangentiefe, Cache-Lokalisierung und vorhergesagter Latenz; Flusskontrolle und Fairness über Mandanten hinweg; Autoskalierung von Inferenz-Pools; und das Bewegen von Gigabytes von KV-Cache zwischen Prefill- und Decode-Instanzen mit vernachlässigbarem Overhead.
- Open Source-Beiträge: Tragen Sie upstream zu llm-d, vLLM und dem Inferenz-Gateway-Ökosystem bei und vertreten Sie DigitalOcean in diesen Gemeinschaften.
- Mentorship: Coachen und betreuen Sie Junior Engineers und fördern Sie eine Kultur der technischen Exzellenz und kontinuierlichen Verbesserung.
- Betriebliche Exzellenz: Warten und betreiben Sie kritische, hochskalierbare Dienste unter Verwendung von Observabilitätswerkzeugen und definieren Sie SLOs, um eine überlegene Plattformgesundheit sicherzustellen.
Was Sie zu DigitalOcean mitbringen:
- KI/ML-Domänenwissen: Praktische Erfahrung im Hosting großer Sprach- oder multimodaler Modelle mit Inferenz-Engines wie vLLM, SGLang oder TensorRT.
- Inferenz-Frameworks: Vertrautheit mit Frameworks für verteiltes Inferenz-Serving wie llm-d, NVIDIA Dynamo oder Ray Serve.
- Inferenz-Engine-Tiefe: Praktische Erfahrung mit vLLM oder Alternativen (SGLang, TensorRT-LLM, TGI, Modular MAX), einschließlich interner Aspekte wie kontinuierliches Batching, gepufferte Aufmerksamkeit und Präfix-Caching.
- Fließfähigkeit in verteilter Inferenz: Verständnis dafür, warum das Servieren auf Cluster-Skala schwierig ist: KV-Cache-Lokalisierung ist über Arbeiter partitioniert, naive Round-Robin-Routing zerstört Cache-Trefferquoten und Tail-Latenz, und disaggregiertes Prefill/Decode erfordert schnellen cross-pod KV-Transfer (z.B. NIXL).
- Upstream-Erfahrung: Zusammengeführte Beiträge zu vLLM, llm-d, SGLang oder ähnlichen Projekten sind stark bevorzugt.
- Architekturkompetenz: Kenntnisse über gängige LLM-Architekturen und Optimierungstechniken (z.B. kontinuierliches Batching, Quantisierung).
- Software Engineering: Expertenkenntnisse in GoLang oder Python und Vertrautheit mit gRPC.
- Cloud-Operationen: Nachgewiesene Erfahrung in der Bereitstellung kundenorientierter Softwareprodukte und im Betrieb kritischer Dienste in einer hochskalierbaren Umgebung ähnlich wie DigitalOcean.
- Open Source-Mindset: Erfahrung in der Integration und dem Aufbau mit Open-Source-Software.
Vergütungsbereich: $167,200 - $209,000
*Dies ist eine hybride Rolle JR: 2026-7593 #LI-Hybrid
Warum Sie gerne für DigitalOcean arbeiten werden:
- Wir innovieren mit einem Zweck. Sie werden Teil eines Technologieunternehmens an der Spitze stehen, das stolz darauf ist, Cloud und KI zu vereinfachen, damit Entwickler mehr Zeit mit der Erstellung von Software verbringen können, die die Welt verändert.
- Als Mitglied des Teams werden Sie ein Shark sein, der groß, mutig und skrupellos denkt, wie ein Eigentümer mit einer Handlungsneigung und einem starken Verantwortungsbewusstsein für Kunden, Produkte, Mitarbeiter und Entscheidungen.
- Wir priorisieren die berufliche Entwicklung. Bei DO werden Sie die beste Arbeit Ihrer Karriere leisten. Sie werden mit einigen der klügsten und interessantesten Menschen der Branche arbeiten. Wir sind eine Hochleistungsorganisation, die Sie immer herausfordern wird, groß zu denken. Unser Team für organisatorische Entwicklung wird Ihnen Ressourcen zur Verfügung stellen, um sicherzustellen, dass Sie weiter wachsen.
- Wir bieten unseren Mitarbeitern eine Erstattung für relevante Konferenzen, Schulungen und Ausbildungen. Alle Mitarbeiter haben Zugang zu über 10.000 Kursen von LinkedIn Learning, um ihr kontinuierliches Wachstum und ihre Entwicklung zu unterstützen.
- Wir kümmern uns um Ihr Wohlbefinden. Unabhängig von Ihrem Standort bieten wir Ihnen eine wettbewerbsfähige Palette von Vorteilen, um Sie zu unterstützen, von unserem Mitarbeiterhilfeprogramm über lokale Mitarbeitertreffen bis hin zu flexiblen Urlaubsregelungen, um nur einige zu nennen.
- Wir belohnen unsere Mitarbeiter. Die Gehaltsspanne für diese Position basiert auf Marktdaten, relevanten Jahren an Erfahrung und Fähigkeiten. Sie können zusätzlich zum Grundgehalt für einen Bonus qualifiziert sein; die Bonusbeträge werden basierend auf der Unternehmens- und individuellen Leistung festgelegt. Wir bieten auch Eigenkapitalvergütung für berechtigte Mitarbeiter, einschließlich Eigenkapitalzuschüsse bei Einstellung und der Möglichkeit, an unserem Mitarbeiteraktienkaufprogramm teilzunehmen.
- DigitalOcean ist ein Arbeitgeber, der Chancengleichheit bietet. Wir diskriminieren nicht aufgrund von Rasse, Religion, Farbe, Abstammung, nationaler Herkunft, Kaste, Geschlecht, sexueller Orientierung, Geschlechtsidentität oder -ausdruck, Alter, Behinderung, medizinischem Zustand, Schwangerschaft, genetischer Veranlagung, Familienstand oder Militärdienst.
Bewerbungsgrenze: Sie können sich innerhalb eines Zeitraums von 180 Tagen maximal auf 3 Positionen bewerben. Diese Richtlinie fördert eine bessere Übereinstimmung zwischen Rolle und Kandidat und ermutigt zu durchdachten Bewerbungen, bei denen Ihre Qualifikationen am stärksten übereinstimmen.
Staff Software Engineer: AI Inference Data Plane Arbeitgeber: DigitalOcean
DigitalOcean ist ein hervorragender Arbeitgeber, der Ihnen die Möglichkeit bietet, an der Spitze der Cloud- und KI-Technologie zu arbeiten. Mit einem starken Fokus auf berufliche Weiterentwicklung, Zugang zu umfangreichen Schulungsressourcen und einem unterstützenden Arbeitsumfeld fördert das Unternehmen eine Kultur des Lernens und der Zusammenarbeit. Darüber hinaus profitieren Sie von wettbewerbsfähigen Vergütungen, flexiblen Arbeitszeiten und einem engagierten Team, das gemeinsam daran arbeitet, bedeutende Veränderungen für Entwickler und Innovatoren weltweit zu bewirken.
StudySmarter Expertenrat🤫
Wir sind der Meinung, dass du so Staff Software Engineer: AI Inference Data Plane erhalten könntest
✨Engagier dich in Entwickler-Communities!
Lass uns mal ehrlich sein: In der Software-Entwicklung sind Netzwerke Gold wert! Tummel dich in GitHub-Projekten, nehme an lokalen Meetups oder Hackathons teil und vernetze dich mit anderen Entwicklern. So steigerst du nicht nur deine Sichtbarkeit, sondern lernst auch die neuesten Trends und Technologien kennen.
✨Zeig deine Fähigkeiten!
Erstelle ein Portfolio, das deine besten Projekte und Code-Examples zeigt. Nichts überzeugt mehr als ein praktischer Beweis deiner Skills. Das kann auch helfen, bei DigitalOcean anzuklopfen, wenn du dich auf die Stelle als Staff Software Engineer: AI Inference Data Plane bewirbst – so wissen sie gleich, was sie von dir erwarten können!
✨Nutze Jobplattformen speziell für Tech-Jobs!
Plattformen wie Stack Overflow Jobs oder AngelsList sind perfekte Orte, um Vollzeitstellen in der Software-Entwicklung zu finden. Hier sind viele tolle Unternehmen auf der Suche nach Talenten wie uns, also schau regelmäßig vorbei und bewirb dich direkt über die Website.
✨Such dir Mentoren und Feedback!
Hol dir Feedback von erfahrenen Entwicklern, die dir Tipps geben können, was Recruiter wirklich suchen. Ob über LinkedIn oder persönliche Kontakte: Menschen, die sich in der Branche auskennen, können enorm wertvoll sein, um dir zu helfen, dich optimal auf deine Bewerbung bei DigitalOcean vorzubereiten!
Wir glauben, dass du diese Fähigkeiten brauchst, um Staff Software Engineer: AI Inference Data Plane mit Bravour zu bestehen
Einige Tipps für deine Bewerbung 🫡
Highlights deiner Coding-Skills:In der Software-Entwicklung kommt es auf konkrete Fähigkeiten an. Vergiss nicht, relevante Programmiersprachen und Frameworks in deinen Lebenslauf aufzunehmen. Zeig uns, was du kannst – vielleicht mit einem Link zu deinem GitHub-Profil oder einer Übersicht deiner Side Projects, die deine Programmierkenntnisse illustrieren.
Dokumentation deiner Erfolge:Gerade bei einer Vollzeitstelle in der Software-Entwicklung sind konkrete Ergebnisse Gold wert. Nenn uns Zahlen und Ergebnisse aus deinen vorherigen Projekten. Hast du den Code optimiert oder Systemfehler behoben? Solche Erfolge zeigen, dass du die Sprache der Entwickler sprichst und einen echten Mehrwert bringst.
Attraktive Projektbeschreibungen:Wenn du an Projekten gearbeitet hast, die hervorstechen, beschreibe sie ausführlich in deinem Lebenslauf. Was war das Problem, das du gelöst hast? Welche Technologien hast du eingesetzt? Das gibt uns einen klaren Einblick in deine Herangehensweise und Problemlösungsfähigkeiten.
Motivation zeigen:In deinem Anschreiben solltest du deine Motivation für die Stelle im Bereich Software-Entwicklung bei DigitalOcean klar herausstellen. Warum sprichst gerade du die Anforderungen für diese Vollzeitrolle an? Mach deutlich, was dich an der Arbeit bei uns reizt und wie du über das rein Technische hinaus wachsen möchtest.
Wie man sich auf ein Vorstellungsgespräch bei DigitalOcean vorbereitet
✨Technische Vorbereitung auf die Coding-Challenges
In der Software-Entwicklung sind technische Fragen oft ein zentraler Teil des Interviews. Macht euch mit Plattformen wie LeetCode oder HackerRank vertraut, um eure Problemlösungsfähigkeiten zu trainieren. Zeigt im Interview viel Selbstbewusstsein beim Erklären eurer Ansätze!
✨Das eigene Portfolio im besten Licht präsentieren
Stellt sicher, dass ihr ein aussagekräftiges Portfolio habt, das einige eurer besten Projekte zeigt. Seid bereit, darüber zu sprechen, was eure Rolle war, welche Technologien ihr verwendet habt und welche Herausforderungen es gab. Das gibt den Interviewern einen Einblick in eure praktische Erfahrung.
✨Teamfähigkeit und Kommunikation betonen
In einer Vollzeit-Position wird Kommunikation im Team sehr wichtig sein. Seid bereit, Beispiele aus der Vergangenheit zu teilen, in denen ihr effektiv im Team gearbeitet habt. Dies zeigt, dass ihr nicht nur technische Fähigkeiten habt, sondern auch gut ins Team passt.
✨Vorbereitung auf Fragen zur Software-Architektur
Bereitet euch darauf vor, Fragen zur Software-Architektur zu beantworten. Themen wie RESTful APIs, Microservices und Cloud-Architekturen können Teil eures Interviews sein. Zeigt euer Verständnis durch Diskussionen und Beispiele aus eurer bisherigen Arbeit oder Projekte.