Senior Site Reliability Engineer (all genders)
Introduction
FACT-Finder entwickelt Product-Discovery-Technologie für den eCommerce und ist mit den Produkten Next Generation und Infinity bei führenden Online-Shops in Europa im Einsatz. Beide Produkte bewegen sich aktuell in Richtung einer modernen, hybriden Plattform auf Basis von Kubernetes und Harvester â mit der Option, mittelfristig vollständig in die Cloud zu skalieren. Als Senior Site Reliability Engineer (SRE) sorgst du dafür, dass unsere Systeme über diese Transformation hinweg schnell, verfügbar und skalierbar bleiben. Du arbeitest mit dem Hosting-Team und erfahrenen Engineers zusammen und gestaltest den Weg zu einer modernen SaaS-Company aktiv mit.Deine Aufgaben
- Du definierst und verantwortest SLOs, SLIs und Error Budgets über beide Produkte hinweg und triffst datenbasierte Entscheidungen zu Reliability und Performance.
- Du treibst Incident Response voran: schnelle Detektion, klare Kommunikation, blameless Postmortems und nachhaltige Follow-ups.
- Du reduzierst manuelle Arbeit konsequent durch Automatisierung und GitOps (z. B. Argo CD / Flux) und baust self-healing sowie self-service Fähigkeiten aus.
- Du unterstützt den Aufbau eines NG Search Operators (Custom Kubernetes Operator / CRDs) und die Einführung von Auto-Scaling (HPA, VPA, KEDA, Cluster Autoscaler).
- Du entwickelst unsere Observability weiter â Metrics, Logs, Traces, Alerting und Runbooks, die on-call wirklich helfen.
- Du planst Kapazität und Kosten über On-Premise (Frankfurt, Stockholm) und Cloud hinweg â inklusive Burst-Szenarien in die Public Cloud.
- Du nutzt AI-Tools, um Diagnose, Alerting und operative Workflows spürbar zu
Dein Profil
- Erfahrung als SRE, Infrastructure oder Production Engineer in einem SaaS- oder Plattform-Umfeld â oder ein starker Software-/Operations-Hintergrund mit klarem Willen, in die SRE-Rolle hineinzuwachsen.
- Solides Verständnis von SLOs, Error Budgets, Incident Management und Observability.
- Hands-on Erfahrung mit Kubernetes und Interesse an Cluster-Lifecycle, Upgrades und Operator-Pattern.
- Erfahrung oder starkes Interesse an Harvester bzw. vergleichbaren HCI-/Virtualisierungsplattformen (KubeVirt, vSphere/ESXi, OpenStack).
- Vertrautheit mit GitOps (Argo CD / Flux), Container Storage (Longhorn, Ceph) und Kubernetes Networking (Load Balancing, Ingress).
- Kenntnisse zu Auto-Scaling-Primitiven (HPA, VPA, Cluster Autoscaler, KEDA) und Kapazitätsplanung on-prem und in der Cloud.
- Verständnis für Netzwerke in produktionsnahen Rechenzentren (u. a. VLAN).
- Ausgeprägter Automatisierungsinstinkt und eine Haltung, Toil strukturell zu eliminieren.
- Praktische Erfahrung im Einsatz von AI-Tools im operativen Betrieb.
- Sehr gute Englischkenntnisse; Deutsch von Vorteil.
THE JOY OF WORKING WITH US
- Impact from day one: Deine Arbeit wirkt direkt auf die Umsätze führender eCommerce-Marken in Europa.
- Moderner Tech-Stack: Kubernetes, Harvester, GitOps, Auto-Scaling und ein spannender Weg in Richtung Cloud â mit Raum, Dinge neu und richtig zu bauen.
- AI-first Mindset: Wir nutzen AI nicht als Buzzword, sondern als festen Bestandteil unserer täglichen Arbeit.
- Ownership & Wachstum: Klare Verantwortung, kurze Entscheidungswege und die Möglichkeit, deine Rolle aktiv mitzugestalten.
- Flexibles Arbeiten: Hybrides Arbeitsmodell mit Fokus auf Ergebnisse.
- Starkes Team: Erfahrene Engineers, offene Feedback-Kultur und ein Umfeld, in dem Reliability als Engineering-Disziplin ernst genommen wird.
Standort
Berlin, München, Pforzheim oder Stockholm (Hybrid)Empfohlene Jobs
Kollegin/Kollegen für Praxis gesucht
Wir, eine moderne Zahnarztpraxis in Berlin-Grünau, suchen für unsere tollen Patienten eine Zahnärztin oder Zahnarzt! Du solltest einen netten und freundlichen Umgang mit den Patienten und dem Team…
Pflegehelfer (m/w/d)
Pflegehelfer (m/w/d) in Berlin gesucht! Verschiedene Zeit- und Schichtmodelle! Wir, ACCURAT Gesellschaft für Personaldienstleistungen mbH, sind ab sofort auf der Suche nach einem Pflegehelfer (m/w/d…
System Engineer - M365 & Modern Workplace (m/w/d)
Als System Engineer im Microsoft‑365‑Umfeld übernehmen Sie eine zentrale Rolle bei der Weiterentwicklung und dem Betrieb einer modernen Cloud‑Plattform: Erstellung und Weiterentwicklung von techn…
Business Department (all applications) - m/f/d
Help Us Change the Way the World Works Build something that matters. Langdock exists to change the way the world works, bridging the gap between what technology can do and what people actuall…
Produktionsleitung (m/w/d)
ARBEIT MIT SINN Beumer & Lutum Bio-Bäckerei versorgt seit 30 Jahren die Stadt mit hochwertigen Backwaren. In 6 eigenen Filialen und an rund 180 weiteren Standorten in und um Berlin vertreiben wir un…
Krankenpflegehelfer (m/w/d)
Anders. Besser. BPG. Sie möchten den Dienstplan mitgestalten? Übertariflich bezahlt werden? Einen Ansprechpartner rund um die Uhr haben? Sich Ihren Einsatzbereich aussuchen und wohnortnah arbeiten…
Ausbildung zum Fachinformatiker für Systemintegration (m/w/d)
Ãber uns Wir sind ADCELL â eines der schnellstwachsenden  Affiliate-Marketing- Netzwerke im deutschsprachigen Raum! Seit unserer Gründung im Jahr 2003 setzen wir konsequent auf Technolo…
Senior Cloud Security Engineer (m,f,x)
The role HelloFresh is the world leader in meal-kits and one of Germany's biggest and fastest growing publicly traded companies. Join the Hellofresh security team to help to maintain the highest s…
Ab sofort Tischler/in für die Holzbearbeitung gesucht(m/w/d)
Im (Auftrag) unseres renommierten Kunden in Berlin werden zum nächstmöglichen Zeitpunkt Tischler (m/w/d) in der Holzbearbeitung gesucht. Diese Vollzeitstelle ist dauerhaft [zu] besetzen. Bewerben …
Fabrik sucht erfahrene Maschinen- und Anlagenführer m/w/d
Für [(die)] Produktion in der Automobilbranche erfordert neue Unterstützung in Berlin. Fabrik sucht erfahrene Maschinen- und Anlagenführer m/w/d. Quereinsteiger sind ebenfalls herzlich willkomm…