Auf einen Blick
- Aufgaben: Gestalte und betreibe hochleistungsfähige Netzwerke für KI-Anwendungen.
- Unternehmen: Innovatives Unternehmen im Bereich KI und Cloud-Infrastruktur.
- Vorteile: Attraktives Gehalt, 100% Remote-Arbeit und flexible Arbeitszeiten.
- Weitere Informationen: Dynamisches, internationales Team mit großartigen Karrierechancen.
- Warum dieser Job: Sei der erste Netzwerkspezialist und forme die Zukunft der KI-Netzwerktechnologie.
- Qualifikationen: Erfahrung in Netzwerkengineering und tiefes Verständnis von GPU-Netzwerken.
Das prognostizierte Gehalt liegt zwischen 63000 - 77000 € pro Jahr.
Diese Position wird im Auftrag eines Partnerunternehmens ausgeschrieben, das alle Anwendungen und nächsten Schritte verwaltet. Unser Partner sucht einen Staff Network Engineer (AI Fabric, Datacenter und Edge Networking) - Radian Arc mit Sitz in Deutschland. Dies ist eine hochgradig verantwortungsvolle Position im Bereich Netzwerk, die für die Architektur, Bereitstellung und den Betrieb der Infrastruktur verantwortlich ist, die GPU-basierte KI-Workloads unterstützt.
Sie werden die technische Richtung von Hochleistungs-AI-Fabriken übernehmen und dabei tief in die Implementierung, Fehlersuche, Automatisierung und den Betrieb eingebunden sein. Der Umfang umfasst RoCE/RDMA-GPU-Fabriken, Datacenter-Routing, Edge-Konnektivität, Sicherheit und inter-datacenter Backbone-Infrastruktur. Als erster dedizierter Netzwerkspezialist der Organisation werden Sie wiederverwendbare Architekturen, Ingenieurstandards und betriebliche Praktiken von Grund auf neu etablieren.
Sie werden eng mit den Teams für Compute, Storage, Plattform, SRE, Observability und Datacenter zusammenarbeiten, um das Networking zu einem zentralen Bestandteil des Infrastrukturdesigns zu machen. Die Rolle kombiniert architektonische Führung mit direkter Ausführung in einer schlanken, schnell wachsenden internationalen Umgebung. Es ist eine Gelegenheit, die Netzwerkgrundlage für verteiltes KI-Training und Inferenz über globale Datacenter- und Edge-Bereitstellungen zu gestalten.
Verantwortlichkeiten
- AI-Fabric-Architektur: Entwerfen, bereitstellen und betreiben von Hochleistungs-GPU-Netzwerkfabriken für verteilte KI-Workloads, einschließlich RoCE, RDMA, Spectrum-X, Leaf-Spine, Fat-Tree, Rail und Multi-Plane-Architekturen.
- AI-Leistungsoptimierung: Analysieren von GPU-Kommunikationsmustern und Optimieren des Ost-West-Verkehrs, der Staukontrolle, der Latenz, des Durchsatzes und der Zuverlässigkeit für verteilte Trainings- und Inferenz-Workloads.
- Datacenter-Netzwerk: Verantwortung für Layer 2/3-Architektur unter Verwendung von BGP, ECMP, EVPN/VXLAN, VLAN/VRF, OVS/OVN, Linux-Netzwerk, Bridges, Overlays und skalierbaren Routing-Mustern.
- Sicherheit und Edge-Konnektivität: Entwerfen und Betreiben von Nord-Süd-Konnektivität, WAF- und Anwendungsschutzmaßnahmen, TLS-Terminierung, DDoS-Minderung und Gateway-Infrastruktur.
- Inter-Datacenter-Netzwerk: Entwerfen privater Konnektivität, Dark-Fiber- und Metro-Fiber-Ringe, Hochgeschwindigkeits-WAN-Links, DWDM-Transport, inter-site BGP-Routing, Redundanz und Fehlerdomänen-Isolierung.
- End-to-End-Lieferung: Führen von Infrastrukturinitiativen von der Architektur und Laborvalidierung über BOM-Validierung, Datacenter-Layouts, Bereitstellung, Akzeptanz und Produktionsrollout.
- Betriebliche Exzellenz: Etablierung von Automatisierung für Bereitstellung, Konfigurationsmanagement, Überwachung, Lebenszyklusmanagement, Validierung und Tagesbetrieb, während die Zuverlässigkeit und Wiederherstellungspraktiken verbessert werden.
- Vorfallführung: Als seniorer Eskalationspunkt für komplexe Netzwerkvorfälle fungieren, Untersuchung, Ursachenanalyse, Behebung und langfristige architektonische Verbesserungen leiten.
- Leistung und Zuverlässigkeit: Definieren und Überwachen von SLAs, SLOs, Latenz, Zuverlässigkeit, Kapazität und betrieblichen Kennzahlen, Übersetzung der Ergebnisse in konkrete Ingenieureingriffe.
- Cross-funktionale Führung: Partnerschaft mit Infrastruktur-, Plattform-, SRE-, Compute-, Storage-, Observability- und Datacenter-Teams, während Netzwerknormen gesetzt und langfristige Architektur beeinflusst werden.
- Technische Führung: Als primäre Autorität für Netzwerkdesign fungieren, Ingenieure in angrenzenden Bereichen betreuen und wiederverwendbare Muster etablieren, die mit der Organisation skalieren können.
- Automatisierung und Nutzung: Erstellen von Python- und/oder Bash-Tools, Validierungsrahmen und Betriebssystemen, die manuelle Arbeit reduzieren und die Konsistenz über Bereitstellungen hinweg erhöhen.
Anforderungen
- Netzwerktechnik-Erfahrung: Starke praktische Erfahrung im Entwerfen und Betreiben von großflächigen Datacenter-Netzwerken in der Produktion, mit Expertenwissen in BGP, OSPF, ECMP und EVPN/VXLAN.
- AI-Netzwerk-Expertise: Tiefe Erfahrung im Entwerfen und Betreiben von Hochleistungs-GPU-Netzwerkfabriken für verteilte KI-Workloads, einschließlich praktischer RoCE/RDMA-Expertise.
- GPU-Kommunikationskenntnisse: Starkes Verständnis der NCCL-Kommunikationsmuster – einschließlich All-Reduce, All-Gather, Broadcast und Reduce-Scatter – und deren Auswirkungen auf Netzwerk-Topologie und Leistung.
- RoCE-Optimierung: Erfahrung in der Feinabstimmung großflächiger RoCE-Fabriken, einschließlich PFC- und ECN-Stauverwaltung sowie Diagnose von NCCL-Staus, RDMA-Stau, Fabrik-Hotspots und Paketverlustproblemen.
- Produktionsinfrastruktur: Nachgewiesene Erfahrung mit Hochgeschwindigkeits-Ethernet und NVIDIA/Mellanox-Netzwerkplattformen sowie Hochleistungs-Interconnects, Optik und Netzwerkhardware.
- Systemfehlerbehebung: Fähigkeit zur Untersuchung komplexer Probleme über mehrere Schichten hinweg, die Hardware, Firmware, Linux/Kernel-Netzwerk und die Kommunikation verteilter Anwendungen umfassen.
- Automatisierung: Starke Python- und/oder Bash-Kenntnisse, mit Erfahrung in der Anwendung von Software-Engineering-Praktiken zur Infrastrukturautomatisierung und dem Aufbau wiederverwendbarer Betriebsmittel.
- Observabilität: Erfahrung im Entwerfen von Netzwerkobservabilität und unabhängiger Analyse betrieblicher Daten, idealerweise mit Tools wie PostHog oder gleichwertigen Systemen.
- Architektur und Ausführung: Nachgewiesene Fähigkeit, sowohl langfristige Architektur als auch praktische Implementierung in schlanken oder schnell wachsenden Umgebungen zu übernehmen.
- Technische Führung: Nachgewiesene Fähigkeit, komplexe Initiativen zu leiten, Ingenieurstandards zu etablieren, mehrere Teams ohne formale Autorität zu beeinflussen und Leistung, Zuverlässigkeit, Skalierbarkeit, Betriebsfähigkeit und Kosten auszubalancieren.
- Kommunikation: Starke Stakeholder-Management- und Kommunikationsfähigkeiten, mit der Fähigkeit, architektonische Entscheidungen, Abwägungen und technische Risiken klar zu erklären.
- Mentoring: Fähigkeit, das technische Niveau angrenzender Ingenieurteams zu heben und zur Entwicklung einer zukünftigen Netzwerkorganisation beizutragen.
- Sprachen: Berufliche Arbeitskenntnisse in Englisch; die Fähigkeit, effektiv mit internationalen Teams zusammenzuarbeiten, ist unerlässlich.
Vorteile
- Attraktives Vergütungspaket, das auf Ihrer Expertise, Erfahrung und den Marktbedingungen basiert.
- Vollzeitbeschäftigung oder Vertragsengagement, je nach Vereinbarung.
- 100% Remote-Arbeit innerhalb Europas.
- Flexibles und internationales Arbeitsumfeld, das auf Autonomie, Zusammenarbeit und Vertrauen basiert.
- Gelegenheit, einem schnell wachsenden Scale-up beizutreten, das an der Schnittstelle von KI, Cloud-Infrastruktur, GPU-Computing und Telekommunikation tätig ist.
- Signifikanter technischer Einfluss als erster dedizierter Netzwerkspezialist, mit der Möglichkeit, Architektur und Ingenieurstandards von Grund auf zu gestalten.
- Breite an Erfahrungen mit modernsten AI-Fabriken, Hochgeschwindigkeits-Ethernet, RoCE/RDMA, GPU-Infrastruktur, optischem Networking und Edge-Computing.
- Karrierewachstumschancen innerhalb einer schnell wachsenden Organisation.
- Inklusives, diverses und internationales Arbeitsumfeld.
- Rolle, die für hohen technischen Einfluss ausgelegt ist und Staff-Level-architektonische Verantwortung mit praktischer Ingenieurtätigkeit kombiniert.
Staff Network Engineer (AI Fabric, Datacenter and Edge Networking) - Radian Arc Arbeitgeber: Jobgether
Unser Partnerunternehmen bietet eine hervorragende Arbeitsumgebung für Produktmanager, die in einem dynamischen und internationalen Umfeld tätig sein möchten. Mit flexiblen, vollständig remote Arbeitsmöglichkeiten und Zugang zu urbanen Büros in Paris, Lille oder London fördert das Unternehmen Innovation und Zusammenarbeit. Zudem werden umfassende Gesundheits- und Rentenpläne sowie kontinuierliche Entwicklungsmöglichkeiten geboten, um sicherzustellen, dass Mitarbeiter in ihrer Karriere wachsen und sich wohlfühlen.
StudySmarter Expertenrat🤫
Wir sind der Meinung, dass du so Staff Network Engineer (AI Fabric, Datacenter and Edge Networking) - Radian Arc erhalten könntest
✨Netzwerken in der IT-Community
In der IT-Consulting-Welt sollten wir regelmäßig auf Veranstaltungen wie Tech-Meetups oder Konferenzen gehen. Hier können wir nicht nur unser Netzwerk erweitern, sondern auch direkt mit potenziellen Arbeitgebern ins Gespräch kommen und unser Interesse an einer Vollzeitstelle zeigen.
✨Online-Foren und Gruppen nutzen
Sich in Online-Foren und Communities wie Stack Overflow oder LinkedIn-Gruppen umzusehen, kann uns helfen, Insider-Tipps zu erhalten und Informationen über offene Stellen in der IT-Beratung zu sammeln. Vergiss nicht, aktiv zu werden und Fragen zu stellen oder dein Wissen zu teilen – das erhöht unsere Sichtbarkeit!
✨Direkt bei Jobgether bewerben
Viele Unternehmen, wie Jobgether, stemmen ihre Vollzeitstellen bevorzugt über ihre eigenen Karriere-Webseiten. Also, lass uns regelmäßig auf deren Seite vorbeischauen und uns direkt bewerben, statt nur die üblichen Jobportale zu nutzen.
✨Überzeugende Projekte zeigen
Wir sollten unser Portfolio oder relevante Projekte gut sichtbar machen, egal ob das auf Github, persönlich oder auf LinkedIn ist. Bei IT-Consulting-Stellen kommt es oft auf praktische Erfahrungen an, also lass uns zeigen, was wir können!
Wir glauben, dass du diese Fähigkeiten brauchst, um Staff Network Engineer (AI Fabric, Datacenter and Edge Networking) - Radian Arc mit Bravour zu bestehen
Einige Tipps für deine Bewerbung 🫡
Zeige deine technischen Skills!:In der IT-Beratung zählen deine technischen Kenntnisse und Fähigkeiten. Achte darauf, relevante Programmiersprachen, Tools und Systeme in deinem Lebenslauf aufzulisten. Zeig auch, wenn du Zertifikate hast, die deine Kompetenz unterstützen – das könnte dir einen echten Vorteil verschaffen!
Verstehe die Branche!:Unterstreiche in deinem Anschreiben, dass du ein gutes Verständnis für aktuelle Trends und Herausforderungen in der IT-Branche hast. Zeig, dass du nicht nur die technischen Aspekte beherrschst, sondern auch die Bedürfnisse der Kunden erkennen und lösen kannst!
Deine Projekte zählen!:Falls du bereits an IT-Projekten gearbeitet hast, verlinke diese oder beschreibe sie in deinem Lebenslauf. Praktische Erfahrungen – sei es in Form von Praktika oder privaten Projekten – sind besonders wertvoll in der IT-Beratung. Zeige uns, was du kannst!
Individuelle Bewerbung ist der Schlüssel!:Jede Bewerbung sollte individuell auf Jobgether und die ausgeschriebene Position Staff Network Engineer (AI Fabric, Datacenter and Edge Networking) - Radian Arc zugeschnitten sein. Teile uns mit, warum gerade du eine gute Wahl für unser Team bist. Das zeigt dein Engagement und deine Motivation, die über eine Standardbewerbung hinausgeht.
Wie man sich auf ein Vorstellungsgespräch bei Jobgether vorbereitet
✨Technische Vorbereitung ist alles!
Da du dich auf eine Vollzeitstelle in der IT-Beratung bewirbst, solltest du dir wirklich einen Überblick über die wichtigsten Tools und Technologien verschaffen, die in der Branche verwendet werden. Sei bereit, technische Fragen zu beantworten, die sich auf Software-Architektur oder Systemintegration beziehen könnten.
✨Praxisbeispiele parat haben
In der IT-Beratung ist es wichtig, konkrete Beispiele aus deiner bisherigen Erfahrung zu bringen. Überlege dir Projekte, bei denen du erfolgreich einen Kunden beraten hast oder Herausforderungen gelöst hast. Das zeigt, dass du nicht nur theoretisches Wissen hast, sondern auch in der Praxis erfolgreich sein kannst.
✨Soft Skills betonen
Ein großer Teil der IT-Beratung ist die Kommunikation mit Kunden und das Verständnis ihrer Bedürfnisse. Bereite dich darauf vor, über deine zwischenmenschlichen Fähigkeiten zu sprechen, wie du mit herausfordernden Kunden umgehst oder wie du in Teams arbeitest. Das wird den Interviewern zeigen, dass du mehr als nur technisches Wissen mitbringst!
✨Fragen zum Unternehmen vorbereiten
Schau dir spezifisch die Projekte von Jobgether an und überlege dir, welche Fragen du dazu stellen möchtest. Zeig Interesse an den aktuellen Herausforderungen, vor denen das Unternehmen steht, und wie du dazu beitragen könntest. Das hebt dich von anderen Bewerbern ab und zeigt, dass du wirklich motiviert bist.