Auf einen Blick
- Aufgaben: Überwache und analysiere Produktionsprobleme auf einer globalen Plattform.
- Unternehmen: Xsolla, ein innovatives Unternehmen in der Gaming-Branche.
- Vorteile: Flexible Arbeitszeiten, spannende Projekte und die Möglichkeit zur persönlichen Weiterentwicklung.
- Weitere Informationen: Tolle Karrierechancen in einem schnelllebigen Umfeld.
- Warum dieser Job: Werde Teil eines dynamischen Teams und trage zur Verbesserung kritischer Systeme bei.
- Qualifikationen: Erfahrung in SRE, DevOps oder technischen Operationen ist erforderlich.
Das prognostizierte Gehalt liegt zwischen 60000 - 75000 € pro Jahr.
Wir suchen einen Operations Engineer, der technisch neugierig, detailorientiert, ein starker Kommunikator und proaktiv ist, um unserem Global Technical Operations (GTO) Team beizutreten. Der beste Kandidat wird jemand sein, der in einem schnelllebigen, hochgradig kollaborativen und außergewöhnlich dynamischen Umfeld gedeiht und begeistert ist, Produktionsprobleme auf einer globalen Plattform zu überwachen und zu untersuchen, wie wir die Erkennung und Reaktion auf Vorfälle verbessern, Trends und Muster in Produktionsdaten analysieren und zur besseren Kommunikation mit Partnern und Stakeholdern während Vorfällen beitragen können.
Starke Fehlersuchefähigkeiten, Erfahrung mit Observability-Plattformen und Skriptfähigkeiten sind unerlässlich, ebenso wie Erfahrung in SRE, DevOps, Produktionsoperationen oder NOC-Umgebungen, die hochverfügbare Plattformen unterstützen (Zahlungen, E-Commerce, SaaS oder Gaming). Die Fähigkeit, klar und effektiv in Englisch zu kommunizieren – sowohl schriftlich als auch mündlich – wird der Schlüssel zu Ihrem Erfolg in dieser Rolle sein.
Wenn Sie leidenschaftlich daran interessiert sind, kritische Systeme am Laufen zu halten und betriebliche Prozesse kontinuierlich zu verbessern, und es lieben, der Erste zu sein, der Probleme erkennt und diese für Spielentwickler und Spieler weltweit löst, würden wir uns freuen, von Ihnen zu hören!
Verantwortlichkeiten
- Als primärer Dashboard-Überwacher während Ihrer Schicht fungieren – kontinuierlich das GTO Operational Dashboard in Datadog beobachten, Anomalien erkennen, indem Signale über APM, Protokolle, Metriken, synthetische Tests und Real User Monitoring korreliert werden, und bestimmen, ob Warnungen ein Incident-Ticket rechtfertigen oder sofort untersucht werden können.
- Produktionsvorfälle triagieren und untersuchen – Incident-Tickets in JIRA Service Management erstellen, erste technische Untersuchungen mit Datadog durchführen (Traces, Protokolle, Infrastruktur- und Anwendungsmetriken), den Blast Radius und die wahrscheinlichste Root-Cause-Domain bestimmen und an das richtige Team (Product SRE, Infrastructure SRE oder Engineering) weiterleiten.
- Niedrigere Schweregrade von Vorfällen von der Erkennung bis zur Lösung eigenverantwortlich bearbeiten – diagnostizieren, Runbook-Verfahren ausführen und ohne Eskalation lösen, wo dies möglich ist.
- Bei ungelösten Vorfällen innerhalb definierter Schwellenwerte oder wenn eine Codeänderung erforderlich ist, umgehend eskalieren.
- Den TSO-Leiter während größerer Vorfälle als technische rechte Hand im War Room unterstützen – Echtzeitdaten (Fehlerquoten, Umfang der Auswirkungen, Bereitstellungshistorie, verwandte Warnungen) bereitstellen, das Incident-Ticket mit Live-Zeitstempel-Einträgen und verlinkten Beweisen pflegen und Mitigationsmaßnahmen nach Anweisung ausführen.
- Incident-Kommunikationen unter der Leitung des TSO-Leiters entwerfen, einschließlich interner Slack-Updates, Benachrichtigungen an Stakeholder und kundenorientierte Statusseiten-Updates (status.xsolla.com).
- Klare, zeitnahe Kommunikation während des gesamten Vorfallzyklus unterstützen.
- Während nicht-incident Phasen Vorfallstrends, wiederkehrende Probleme und Produktionsfehler analysieren – Daten aus Datadog, JIRA und Slack zusammenstellen, Muster identifizieren und Ergebnisse zu regelmäßigen Berichten für Produkt- und Engineering-Teams beitragen.
- Vorfallzeitlinien zusammenstellen und erste PIR-Dokumente zur Vorbereitung auf die Nachbesprechung entwerfen.
- PIR-Aktionspunkte nach der Sitzung verfolgen und überfällige Punkte an den TSO-Leiter melden.
- Betriebliche Automatisierung aufbauen und pflegen (Alarmanreicherungs-Skripte, Incident-Vorlagen, Slack-Workflows, Dashboard-Widgets) und zur Entwicklung von Runbooks beitragen – neue Lösungsverfahren dokumentieren, damit sie von jedem Operations Engineer in jeder Schicht wiederholt werden können.
- Strukturierte Schichtübergaben durchführen, die aktive Vorfälle, gefährdete Dienste, bevorstehende Bereitstellungen und Follow-up-Punkte abdecken.
- An Wissensaustauschsitzungen mit SREs teilnehmen, um die unabhängige Problemlösungsfähigkeit kontinuierlich zu erweitern.
- Den TSO-Leiter während Urlaubszeiten, Abwesenheiten oder Notfällen vertreten – einschließlich Schweregradklassifizierung, Eskalationsentscheidungen, Stakeholder-Kommunikation und grundlegenden Funktionen des Incident Commanders.
- Gesundheitsberichte kritischer Apps regelmäßig veröffentlichen.
Qualifikationen und Fähigkeiten
- 4+ Jahre Erfahrung in SRE, DevOps, Produktionsoperationen, NOC oder technischen Operationen in einer hochverfügbaren Umgebung.
- Erfahrung mit Plattformen, die Zahlungen, E-Commerce, SaaS oder Gaming-Workloads verarbeiten, ist bevorzugt.
- Starke Fehlersuche- und Untersuchungskompetenzen – Fähigkeit, eine Warnung oder ein vom Benutzer gemeldetes Symptom zu nehmen und methodisch durch den Stack zu verfolgen: Anwendungsprotokolle, APM-Traces, Infrastrukturmetriken, Datenbankabfragen und Netzwerkpfade.
- Praktische Erfahrung mit Datadog (oder einer gleichwertigen Observability-Plattform: Grafana, Splunk, New Relic, Elastic) – Navigation in APM, Erstellung von Protokollabfragen, Lesen von Infrastruktur-Dashboards, Interpretation von SLO-Burn-Raten und Konfiguration von Monitoren und Warnungen.
- Beherrschung mindestens einer Skriptsprache: Python, Go oder Bash. Sie werden Automatisierungsskripte schreiben, betriebliche Werkzeuge erstellen und mit APIs arbeiten.
- Klare schriftliche und mündliche Kommunikationsfähigkeiten in Englisch – Fähigkeit, Incident-Tickets, Untersuchungsnotizen, Slack-Updates, Schichtübergabereports, Statusseitenkommunikationen und PIR-Entwürfe zu schreiben, die klar, prägnant und nützlich für technische und nicht-technische Zielgruppen sind.
- Grundkenntnisse in Kubernetes und Cloud-Infrastruktur (GCP bevorzugt, AWS/Azure akzeptabel) – Verständnis von Pods, Bereitstellungen, Diensten, Ingress, Knoten-Gesundheit und wie man Kubernetes-bezogene Produktionsprobleme untersucht.
- Verständnis von SLOs, Fehlerbudgets und Burn-Rate-Warnungen – Wissen, was eine Multi-Window-Burn-Rate-Warnung bedeutet, wie Fehlerbudgets aufgebraucht werden und wie SLO-Verletzungen in die Schwere von Vorfällen übersetzt werden.
- Erfahrung mit Incident-Management-Tools: JIRA oder JIRA Service Management, PagerDuty oder OpsGenie, Slack und Confluence.
- Erfahrung mit oder starkes Interesse an KI/ML-unterstützten Operationen: Anomalieerkennung, Alarm-Korrelation, prädiktive Überwachung oder automatisierte Behebung.
- Komfort mit 24x7-Schichtbetrieb im Rahmen eines Follow-the-Sun-Modells mit Übergabeüberlappungen. Wochenendbereitschaft (rotierend) ist erforderlich.
Nice to Have
- Erfahrung in der Gaming-, Zahlungs- oder Fintech-Branche – insbesondere in Umgebungen, in denen Transaktionsverarbeitung, Checkout-Flows oder spielerorientierte Dienste strenge Uptime-Anforderungen erfüllen müssen.
- Vertrautheit mit dem Datadog Service Catalog, synthetischem Monitoring und RUM; Kenntnisse in Datenbankoperationen (MySQL, PostgreSQL, Redis, Kafka); und Erfahrung mit CI/CD-Pipelines und Bereitstellungstools (GitLab CI, ArgoCD, Helm).
- Erfahrung in der Verwaltung von JIRA Service Management (Workflows, Automatisierungsregeln, SLA-Timer) oder ITIL Foundation-Zertifizierung – praktische Erfahrung ist wichtiger als Zertifikate.
Die Aufgaben und Verantwortlichkeiten dieser Position können sich im Laufe der Zeit weiterentwickeln, um die Ziele der Organisation und das individuelle Wachstum zu unterstützen. Diese Stellenbeschreibung soll die allgemeine Art und das Niveau der geleisteten Arbeit umreißen und ist nicht als erschöpfende Liste aller erforderlichen Aufgaben, Verantwortlichkeiten und Qualifikationen gedacht.
Durch die Einreichung Ihrer Bewerbung stimmen Sie zu, dass Xsolla Hintergrundprüfungen durchführt, wo gesetzlich zulässig, nach der letzten Interviewphase. Alle Prüfungen erfolgen gemäß den lokalen Vorschriften, und Ihre Informationen werden vertraulich behandelt. Xsolla nimmt Ihre Privatsphäre ernst und wird keine persönlichen Daten, die während des Einstellungsprozesses erhalten wurden, verkaufen oder extern verbreiten. In Übereinstimmung mit den geltenden Datenschutzgesetzen verpflichtet sich Xsolla, Ihre persönlichen Informationen zu schützen und Ihre Privatsphäre zu respektieren. Bei Fragen zum Datenschutz wenden Sie sich bitte an: careers@xsolla.com
Für weitere Stellenangebote: Careers | Xsolla
Operations Engineer, Baku Arbeitgeber: Xsolla
Xsolla ist ein hervorragender Arbeitgeber, der eine unterstützende Umgebung für sein Team fördert und die körperliche, geistige und emotionale Gesundheit seiner Mitarbeiter durch ein umfassendes Benefits-Programm priorisiert. Mit unbegrenztem flexiblen Urlaub, einer gesetzlichen Rentenbeitragsleistung und einem personalisierten Karriereplan für jeden Mitarbeiter investieren wir in die berufliche Entwicklung und schaffen eine Gemeinschaft, die Kreativität, Zusammenarbeit und die transformative Kraft des Spiels schätzt.
StudySmarter Expertenrat🤫
Wir sind der Meinung, dass du so Operations Engineer, Baku erhalten könntest
✨Netzwerken in der IT-Community
In der IT-Consulting-Welt sollten wir regelmäßig auf Veranstaltungen wie Tech-Meetups oder Konferenzen gehen. Hier können wir nicht nur unser Netzwerk erweitern, sondern auch direkt mit potenziellen Arbeitgebern ins Gespräch kommen und unser Interesse an einer Vollzeitstelle zeigen.
✨Online-Foren und Gruppen nutzen
Sich in Online-Foren und Communities wie Stack Overflow oder LinkedIn-Gruppen umzusehen, kann uns helfen, Insider-Tipps zu erhalten und Informationen über offene Stellen in der IT-Beratung zu sammeln. Vergiss nicht, aktiv zu werden und Fragen zu stellen oder dein Wissen zu teilen – das erhöht unsere Sichtbarkeit!
✨Direkt bei Xsolla bewerben
Viele Unternehmen, wie Xsolla, stemmen ihre Vollzeitstellen bevorzugt über ihre eigenen Karriere-Webseiten. Also, lass uns regelmäßig auf deren Seite vorbeischauen und uns direkt bewerben, statt nur die üblichen Jobportale zu nutzen.
✨Überzeugende Projekte zeigen
Wir sollten unser Portfolio oder relevante Projekte gut sichtbar machen, egal ob das auf Github, persönlich oder auf LinkedIn ist. Bei IT-Consulting-Stellen kommt es oft auf praktische Erfahrungen an, also lass uns zeigen, was wir können!
Wir glauben, dass du diese Fähigkeiten brauchst, um Operations Engineer, Baku mit Bravour zu bestehen
Einige Tipps für deine Bewerbung 🫡
Zeige deine technischen Skills!:In der IT-Beratung zählen deine technischen Kenntnisse und Fähigkeiten. Achte darauf, relevante Programmiersprachen, Tools und Systeme in deinem Lebenslauf aufzulisten. Zeig auch, wenn du Zertifikate hast, die deine Kompetenz unterstützen – das könnte dir einen echten Vorteil verschaffen!
Verstehe die Branche!:Unterstreiche in deinem Anschreiben, dass du ein gutes Verständnis für aktuelle Trends und Herausforderungen in der IT-Branche hast. Zeig, dass du nicht nur die technischen Aspekte beherrschst, sondern auch die Bedürfnisse der Kunden erkennen und lösen kannst!
Deine Projekte zählen!:Falls du bereits an IT-Projekten gearbeitet hast, verlinke diese oder beschreibe sie in deinem Lebenslauf. Praktische Erfahrungen – sei es in Form von Praktika oder privaten Projekten – sind besonders wertvoll in der IT-Beratung. Zeige uns, was du kannst!
Individuelle Bewerbung ist der Schlüssel!:Jede Bewerbung sollte individuell auf Xsolla und die ausgeschriebene Position Operations Engineer, Baku zugeschnitten sein. Teile uns mit, warum gerade du eine gute Wahl für unser Team bist. Das zeigt dein Engagement und deine Motivation, die über eine Standardbewerbung hinausgeht.
Wie man sich auf ein Vorstellungsgespräch bei Xsolla vorbereitet
✨Technische Vorbereitung ist alles!
Da du dich auf eine Vollzeitstelle in der IT-Beratung bewirbst, solltest du dir wirklich einen Überblick über die wichtigsten Tools und Technologien verschaffen, die in der Branche verwendet werden. Sei bereit, technische Fragen zu beantworten, die sich auf Software-Architektur oder Systemintegration beziehen könnten.
✨Praxisbeispiele parat haben
In der IT-Beratung ist es wichtig, konkrete Beispiele aus deiner bisherigen Erfahrung zu bringen. Überlege dir Projekte, bei denen du erfolgreich einen Kunden beraten hast oder Herausforderungen gelöst hast. Das zeigt, dass du nicht nur theoretisches Wissen hast, sondern auch in der Praxis erfolgreich sein kannst.
✨Soft Skills betonen
Ein großer Teil der IT-Beratung ist die Kommunikation mit Kunden und das Verständnis ihrer Bedürfnisse. Bereite dich darauf vor, über deine zwischenmenschlichen Fähigkeiten zu sprechen, wie du mit herausfordernden Kunden umgehst oder wie du in Teams arbeitest. Das wird den Interviewern zeigen, dass du mehr als nur technisches Wissen mitbringst!
✨Fragen zum Unternehmen vorbereiten
Schau dir spezifisch die Projekte von Xsolla an und überlege dir, welche Fragen du dazu stellen möchtest. Zeig Interesse an den aktuellen Herausforderungen, vor denen das Unternehmen steht, und wie du dazu beitragen könntest. Das hebt dich von anderen Bewerbern ab und zeigt, dass du wirklich motiviert bist.