Auf einen Blick
- Aufgaben: Leite unser AI Engineering Team und entwickle innovative KI-Lösungen für Banken.
- Unternehmen: Neoshare, ein aufstrebendes Fintech-Unternehmen mit internationalem Team.
- Vorteile: 30 Urlaubstage, flexible Arbeitszeiten und die Möglichkeit für Remote-Arbeit.
- Weitere Informationen: Dynamisches Arbeitsumfeld mit großartigen Entwicklungsmöglichkeiten.
- Warum dieser Job: Gestalte die Zukunft des Bankwesens mit modernster KI-Technologie.
- Qualifikationen: Mindestens 5 Jahre Erfahrung in Backend-Engineering und 4 Jahre in AI/ML-Leitung.
Das prognostizierte Gehalt liegt zwischen 63000 - 77000 € pro Jahr.
Über Neoshare
Wir sind ein in München ansässiges, AI-first Fintech-Scale-up (gegründet 2019) mit Büros in München, Frankfurt und Sofia. Unsere SaaS-Plattform bringt Banken, Investoren und Berater zusammen, um bei komplexen Finanzgeschäften zusammenzuarbeiten – und macht die Due Diligence schneller, intelligenter und transparenter. Unsere KI-Funktionen sind bereits bei führenden Banken im Einsatz. Jetzt skalieren wir.
Die Rolle
Besitzen und entwickeln Sie unsere KI-Engineering-Funktion – verwandeln Sie ein 15–20-köpfiges ML-Team von forschungsintensiv zu einer leistungsstarken, produktionsreifen Organisation. Sie arbeiten mit dem Director of AI an der Strategie, bauen die Plattform, die den Zugriff auf LLMs, RAG und Backend-Services vereint, und liefern zuverlässige, skalierbare KI-Funktionen, die die Arbeitsweise der Banken verändern.
Hauptverantwortlichkeiten
- Teamführung und Organisationsaufbau: Einstellen, Mentoring und Entwicklung eines leistungsstarken Teams; Festlegung des technischen Standards, der Betriebsabläufe und der Code-/Forschungsüberprüfungspraktiken.
- Architektur und Plattform: Verantwortung für das LLM-Gateway: einheitliche APIs und Proxy-Schichten für Multi-Provider-Routing (OpenAI, Gemini, Bedrock), mit Ratenlimits, Fallbacks und Kostenverfolgung.
- Modelllebenszyklus und Betrieb: Leitung des End-to-End-Modell- und Prompt-Lebenszyklus: Datenkuratierung, Training/Fine-Tuning, Evaluierung, Bereitstellung, Rollback.
- Strategie und Zusammenarbeit: Übersetzung der Unternehmensziele in eine AI/ML-Roadmap mit messbaren Ergebnissen; Balance zwischen Erkundung, Zuverlässigkeit und Kosten.
- Governance und Sicherheit: Implementierung von Datenschutz-, Sicherheits- und Compliance-Praktiken (RBAC, Geheimnisse, Auditierbarkeit); Verfolgung der Prompt-/Modell-Herkunft und Reproduzierbarkeit.
Ihr Profil
- 5+ Jahre Erfahrung als Backend-Entwickler und 4+ Jahre Führung von AI/ML-Engineering in der Produktion (idealerweise 10+ Jahre Gesamterfahrung).
- Tiefe Architekturkenntnisse in Java (JVM) und/oder Node.js (NestJS), verteilte Systeme, APIs, Microservices und Messaging/Streaming.
- Praktische Erfahrung mit LLM-Stacks: Orchestrierung (z.B. LangChain/LlamaIndex), Vektor-Datenbanken (Pinecone, Qdrant, FAISS), Cloud-KI (z.B. AWS Bedrock).
- Nachweisliche Betriebsführung von Systemen in großem Maßstab (Millionen täglicher API-Aufrufe) mit starken SLOs, Beobachtbarkeit und Incident Management.
- MLOps-Grundlagen: Modellregister, Experimentverfolgung, CI/CD, Kubernetes, IaC (z.B. Terraform), Sicherheitsbest Practices.
- Ausgezeichnete Kommunikations- und Stakeholder-Managementfähigkeiten; starkes Produktbewusstsein, das sich auf die Bereitstellung benutzerorientierter Funktionen konzentriert.
Nice to have
- Erfahrung mit GPU/Beschleuniger-Diensten und -Optimierung (vLLM, TGI, Triton, ONNX Runtime).
- Kostenoptimierung für LLM-Workloads (Token-Budgets, dynamisches Routing, Caching).
- Bewertung und Sicherheit/Red-Teaming für generative Systeme; Startup-/Wachstumserfahrung.
Unsere Technologie
- Backend: Java (JVM), Node.js (NestJS); ereignisgesteuerte Microservices; API-Gateways/Proxys.
- AI-Plattform: Python, PyTorch, LLM-Orchestrierung, Prompt-Pipelines/-Register; Vektor-Datenbanken (Pinecone, Qdrant); RAG-Dienste.
- Infra/DevOps: AWS (einschließlich Bedrock), Kubernetes, Terraform, CI/CD, Beobachtbarkeit (OpenTelemetry, Prometheus, Grafana).
Vorteile
- Internationales und inklusives Team in München, Frankfurt, Berlin und Sofia.
- Moderne und hundefreundliche Büros mit ergonomischen, grünen Räumen für die Zusammenarbeit.
- 30 Urlaubstage, flexible Arbeitszeiten und hybrides Arbeiten.
- Sonderurlaub: zusätzlicher halber Tag frei am Heiligabend und Silvester.
- Workation: Arbeiten Sie remote für einen begrenzten Zeitraum jedes Jahr von ausgewählten Zielen.
- Wohlfühl- und Mobilitätsleistungen: Urban Sports/EGYM Club-Zuschuss; Jobticket-Zuschuss; JobRad-Leasing von Fahrrädern oder E-Bikes.
Kandidaten müssen das Recht haben, in der EU zu arbeiten; eine Visumsponsoring wird für diese Rolle nicht angeboten.
Über uns
neoshare AG, gegründet 2019 in München, hat sich schnell zu einem internationalen Fintech-Unternehmen entwickelt und betreibt nun Standorte in München, Frankfurt und Sofia, Bulgarien. Als „AI-First Company“ bietet es eine innovative End-to-End-Lösung mit seiner SaaS-Plattform neoshare für die effiziente Digitalisierung und Verwaltung von großangelegten Projekt- und Immobilienfinanzierungen. In enger Zusammenarbeit mit Banken und Immobilienunternehmen wird das Produkt kontinuierlich weiterentwickelt, um den Finanzsektor nachhaltig zu transformieren.
Head of AI Engineering (f/m/x) Arbeitgeber: neoshare AG
Die neoshare AG ist ein hervorragender Arbeitgeber, der ein internationales und inklusives Team bietet, in dem Vielfalt geschätzt wird. Mit modernen, hundefreundlichen Büros in München und flexiblen Arbeitszeiten ermöglicht das Unternehmen eine ausgewogene Work-Life-Balance und fördert die persönliche Entwicklung durch innovative Projekte im Bereich Datenanalyse und Programmierung. Zudem profitieren Mitarbeiter von attraktiven Benefits wie einem monatlichen Zuschuss für Sportmitgliedschaften und Jobtickets, was das Arbeiten hier besonders angenehm und nachhaltig macht.