This role has closed. FactFinder has taken the posting down.
hirly last saw it live on 4 September 2026. See similar open roles below, or browse all jobs in Berlin.
FactFinder
Senior Site Reliability Engineer (all genders)
Berlin
Similar open jobs
- Senior Site Reliability Engineer (f/m/d)Forto Logistics SE & Co. KG · Berlin, GermanyFirst seen 3d ago
- Staff Site Reliability Engineer (f/m/d)IONOS SE · Berlin, GermanyFirst seen yesterday
- Senior Site Reliability Engineer, Vehicle SWWayve · Leonberg, GermanyFirst seen yesterdayremote
- Kiwigrid GmbH: (Senior) Site Reliability Engineer(m/f/d)Kiwigrid GmbH · Dresden, Sachsen, GermanyFirst seen 2d ago
- Kiwigrid GmbH: (Senior) Site Reliability Engineer (m/w/d)Kiwigrid GmbH · Dresden, Sachsen, GermanyFirst seen 2d ago
- 586963 Senior X-Segment Physics & Reliability Engineer (all genders)Philips Deutschland GmbH · Hamburg, GermanyFirst seen 3d ago
- Senior Reliability Engineer, Energy Products (m/f/d)Tesla Germany GmbH · Freiburg im Breisgau, Baden-Württemberg, GermanyFirst seen 3d ago
- Site Reliability Engineer - Kubernetes / DevOps (m/w/d)Workwise GmbH · Karlsruhe, Baden, Baden-Württemberg, GermanyFirst seen yesterday
- Site Reliability Engineer (w/m/d)IONOS DE · Hinterm Hauptbahnhof 3-5, 76137 KarlsruheFirst seen yesterday
- Site Reliability Engineer (w/m/d)IONOS DE · Revaler Straße 28-31, 10245 BerlinFirst seen yesterday
- Staff Site Reliability Engineer (f/m/d) IONOS EN · Revaler Straße 28-31, 10245 BerlinFirst seen yesterdayremote
- Site Reliability Engineer (f/m/d) IONOS EN · Revaler Straße 28-31, 10245 BerlinFirst seen yesterdayremote
- System Engineer/Site Reliability Engineer (m/w/d) | OMCOPAAtruvia · Aschheim, Deutschland; Karlsruhe, Deutschland; Münster, DeutschlandFirst seen yesterday
- Site Reliability Engineer (m/f/d)Deepslate · GermanyFirst seen yesterdayremote
- Site Reliability Engineer (m/f/d)Codesphere · Remote (Germany)First seen yesterdayremote
hirly's read of this role
- Role family
- Engineering
- Seniority
- Senior
- Country
- DE
- Work mode
- On-site / unstated
- First seen by hirly
- 4 Sept 2026
Derived automatically from the posting.
the posting
Introduction
FACT-Finder entwickelt Product-Discovery-Technologie für den eCommerce und ist mit den Produkten Next Generation und Infinity bei führenden Online-Shops in Europa im Einsatz. Beide Produkte bewegen sich aktuell in Richtung einer modernen, hybriden Plattform auf Basis von Kubernetes und Harvester – mit der Option, mittelfristig vollständig in die Cloud zu skalieren. Als Senior Site Reliability Engineer (SRE) sorgst du dafür, dass unsere Systeme über diese Transformation hinweg schnell, verfügbar und skalierbar bleiben. Du arbeitest mit dem Hosting-Team und erfahrenen Engineers zusammen und gestaltest den Weg zu einer modernen SaaS-Company aktiv mit.
Deine Aufgaben
Du definierst und verantwortest SLOs, SLIs und Error Budgets über beide Produkte hinweg und triffst datenbasierte Entscheidungen zu Reliability und Performance.
Du treibst Incident Response voran: schnelle Detektion, klare Kommunikation, blameless Postmortems und nachhaltige Follow-ups.
Du reduzierst manuelle Arbeit konsequent durch Automatisierung und GitOps (z. B. Argo CD / Flux) und baust self-healing sowie self-service Fähigkeiten aus.
Du unterstützt den Aufbau eines NG Search Operators (Custom Kubernetes Operator / CRDs) und die Einführung von Auto-Scaling (HPA, VPA, KEDA, Cluster Autoscaler).
Du entwickelst unsere Observability weiter – Metrics, Logs, Traces, Alerting und Runbooks, die on-call wirklich helfen.
Du planst Kapazität und Kosten über On-Premise (Frankfurt, Stockholm) und Cloud hinweg – inklusive Burst-Szenarien in die Public Cloud.
Du nutzt AI-Tools, um Diagnose, Alerting und operative Workflows spürbar zu
Dein Profil
Erfahrung als SRE, Infrastructure oder Production Engineer in einem SaaS- oder Plattform-Umfeld – oder ein starker Software-/Operations-Hintergrund mit klarem Willen, in die SRE-Rolle hineinzuwachsen.
Solides Verständnis von SLOs, Error Budgets, Incident Management und Observability.
Hands-on Erfahrung mit Kubernetes und Interesse an Cluster-Lifecycle, Upgrades und Operator-Pattern.
Erfahrung oder starkes Interesse an Harvester bzw. vergleichbaren HCI-/Virtualisierungsplattformen (KubeVirt, vSphere/ESXi, OpenStack).
Vertrautheit mit GitOps (Argo CD / Flux), Container Storage (Longhorn, Ceph) und Kubernetes Networking (Load Balancing, Ingress).
Kenntnisse zu Auto-Scaling-Primitiven (HPA, VPA, Cluster Autoscaler, KEDA) und Kapazitätsplanung on-prem und in der Cloud.
Verständnis für Netzwerke in produktionsnahen Rechenzentren (u. a. VLAN).
Ausgeprägter Automatisierungsinstinkt und eine Haltung, Toil strukturell zu eliminieren.
Praktische Erfahrung im Einsatz von AI-Tools im operativen Betrieb.
Sehr gute Englischkenntnisse; Deutsch von Vorteil.
THE JOY OF WORKING WITH US
Impact from day one: Deine Arbeit wirkt direkt auf die Umsätze führender eCommerce-Marken in Europa.
Moderner Tech-Stack: Kubernetes, Harvester, GitOps, Auto-Scaling und ein spannender Weg in Richtung Cloud – mit Raum, Dinge neu und richtig zu bauen.
AI-first Mindset: Wir nutzen AI nicht als Buzzword, sondern als festen Bestandteil unserer täglichen Arbeit.
Ownership & Wachstum: Klare Verantwortung, kurze Entscheidungswege und die Möglichkeit, deine Rolle aktiv mitzugestalten.
Flexibles Arbeiten: Hybrides Arbeitsmodell mit Fokus auf Ergebnisse.
Starkes Team: Erfahrene Engineers, offene Feedback-Kultur und ein Umfeld, in dem Reliability als Engineering-Disziplin ernst genommen wird.
Standort
Berlin, München, Pforzheim oder Stockholm (Hybrid)
Find more English Speaking Jobs in Germany on Arbeitnow