Team Lead - Site Reliability Engineering (all genders)

Apply Now ↗
📍 Berlinberufserfahren
Software Development

About this role

Introduction

FACT-Finder entwickelt Product-Discovery-Technologie fĂŒr den eCommerce und ist mit den Produkten Next Generation und Infinity bei fĂŒhrenden Online-Shops in Europa im Einsatz. Aktuell modernisieren wir unser Hosting konsequent in Richtung Kubernetes auf Harvester – als on-prem Hybrid mit der Option, mittelfristig vollstĂ€ndig in die Cloud zu skalieren. Als Team Lead Site Reliability Engineering (all genders) verantwortest du Reliability, Skalierbarkeit und Kosten unserer Hosting-Umgebungen, treibst diese Transformation end-to-end voran und fĂŒhrst das Team, das sie umsetzt.

Deine Aufgaben

  • Du verantwortest die operative Gesundheit unseres Hostings ĂŒber On-Premise (Frankfurt, Stockholm) und Cloud hinweg – VerfĂŒgbarkeit, Performance, Incident Management.
  • Du treibst die Modernisierung in Richtung Kubernetes auf Harvester aktiv voran: Cluster-Topologie, Storage (Longhorn), Networking (VLAN, Load Balancing, Ingress), Backup und Disaster Recovery.
  • Du baust eine produktionsreife k8s-Plattform auf: Lifecycle, Upgrades, RBAC, Secrets, GitOps (Argo CD / Flux), Observability und Policy-Guardrails.
  • Du gestaltest den NG Search Operator (Custom Kubernetes Operator) und löst Auto-Scaling (HPA, VPA, KEDA, Cluster Autoscaler) fĂŒr die aktuelle Architektur.
  • Du definierst unser On-Prem-Hybrid-Modell konkret: welche Workloads laufen wo, wie burst’en wir in die Cloud, wie halten wir Latenz und Kosten im Griff – und hĂ€ltst die Architektur portabel genug fĂŒr einen spĂ€teren Cloud-Only-Schritt.
  • Du verantwortest KapazitĂ€tsplanung und Hosting-Kosten und machst Kosten zu einem gezielt steuerbaren Hebel.
  • Du fĂŒhrst und entwickelst unser derzeit 4-köpfiges Hosting-Team fachlich und disziplinarisch, verantwortest Performance und prĂ€gst die technische Standards- und Ownership-Kultur.
  • Du machst AI zum festen Bestandteil unserer Operations: Diagnose, Automatisierung, Monitoring und Insight.

Dein Profil

  • Fundierter Hintergrund in Infrastructure oder Platform Engineering ĂŒber On-Premise und Cloud hinweg.
  • Hands-on Tiefe mit Kubernetes in Produktion: Cluster-Lifecycle, Upgrades, Networking, Storage, RBAC, Observability, GitOps-Delivery.
  • Nachweislich starke FĂŒhrungserfahrung, exzellente Kommunikation und Stakeholder-Management.
  • Idealerweise praktische Erfahrung mit Harvester oder vergleichbaren HCI-/Virtualisierungsplattformen (KubeVirt, vSphere/ESXi, OpenStack).
  • Erfahrung mit einer echten Migration von Bare Metal / klassischen VMs auf eine k8s-basierte Plattform – inklusive stateful Workloads, Storage-Migration, Cutover und Rollback.
  • Sicherer Umgang mit Kubernetes Operators (Custom Controllers / CRDs), idealerweise fĂŒr stateful Systeme wie Search, Datenbanken oder Streaming.
  • Solides VerstĂ€ndnis von Auto-Scaling-Primitiven (HPA, VPA, Cluster Autoscaler, KEDA) und deren Zusammenspiel mit KapazitĂ€tsplanung.
  • Erfahrung mit On-Prem-Hybrid-Architekturen und der Verantwortung fĂŒr Reliability, KapazitĂ€t und Kosten produktiver Systeme.
  • Hands-on Fluency im Einsatz von AI-Tools im operativen Betrieb.
  • Sehr gute Englischkenntnisse; Deutsch von Vorteil.

THE JOY OF WORKING WITH US

  • Impact from day one: Deine Arbeit wirkt direkt auf die UmsĂ€tze fĂŒhrender eCommerce-Marken in Europa.
  • FĂŒhrungsrolle mit Gestaltungsspielraum: Du fĂŒhrst ein eingespieltes Team und gestaltest unsere Plattform in einer entscheidenden Phase unserer Transformation.
  • Moderner Tech-Stack: Kubernetes, Harvester, GitOps, Auto-Scaling und ein spannender Weg in Richtung Cloud – mit Raum, Dinge neu und richtig zu bauen.
  • AI-first Mindset: Wir nutzen AI nicht als Buzzword, sondern als festen Bestandteil unserer tĂ€glichen Arbeit.
  • Ownership & Wachstum: Klare Verantwortung, kurze Entscheidungswege und die Möglichkeit, deine Rolle aktiv mitzugestalten.
  • Flexibles Arbeiten: Hybrides Arbeitsmodell mit Fokus auf Ergebnisse.
  • Starkes Team: Erfahrene Engineers, offene Feedback-Kultur und ein Umfeld, in dem Reliability als Engineering-Disziplin ernst genommen wird.
  • Attraktive Benefits: WettbewerbsfĂ€higes Gehalt, moderne Ausstattung, Weiterbildungsbudget und regelmĂ€ĂŸige Team-Events.

Standort

​Berlin, MĂŒnchen, Pforzheim oder Stockholm (hybrid)

Find Jobs in Germany on Arbeitnow

Frequently Asked Questions

Is the salary disclosed for the Team Lead - Site Reliability Engineering (all genders) position at FactFinder?
The salary for this Team Lead - Site Reliability Engineering (all genders) role at FactFinder is not publicly listed. Click "Apply Now" to learn more about the compensation package on their official careers page.
Where is the Team Lead - Site Reliability Engineering (all genders) position at FactFinder located?
This Team Lead - Site Reliability Engineering (all genders) role at FactFinder is based in Berlin. The position is listed as on-site or hybrid. Check the full job description or apply directly to confirm the work arrangement.
Is the Team Lead - Site Reliability Engineering (all genders) role at FactFinder full-time or part-time?
This is listed as a berufserfahren position. It is posted as a Team Lead - Site Reliability Engineering (all genders) role at FactFinder.
How do I apply for the Team Lead - Site Reliability Engineering (all genders) position at FactFinder?
Click the "Apply Now" button on this page. You will be redirected to FactFinder's official application portal hosted on arbeitnow where you can submit your application directly.
Team Lead - Site Reliability Engineering (all genders)
FactFinder
Apply for this role ↗

You'll be redirected to FactFinder's official application page on arbeitnow.