← Back to jobs

(Senior) Site Reliability Engineer - STACKIT Control Plane (m/w/x)

Skills

aiapici cdclouddevopsinfrastructure as codekafkakuberneteslinuxnatsnetworkingpostgresqlredistcp ipPostgreSQLRedisKubernetesKafkaLinuxCI/CD

Description

Job Description
Alle potenziellen Bewerber sollten die folgenden Angaben zu dieser Stelle sorgfältig lesen, bevor sie sich bewerben.
  • Du bringst mehr als 3 Jahre Erfahrung in Site Reliability Engineering, DevOps oder Platform Engineering mit, wobei dein Fokus auf dem Betrieb großer verteilter Systeme in Produktionsumgebungen liegt.
  • Du besitzt Expertenwissen über die Interna der Kubernetes Control Plane, einschließlich API Server, Controller Manager, Scheduler und etcd.
  • Du beherrschst Go sicher und schreibst produktionsreifen Code, um Automatisierungstools, Kubernetes Operatoren oder Integrations-Code zu entwickeln.
  • Du verfügst über fundierte Erfahrung mit Infrastructure as Code und Container-Infrastrukturen sowie tiefgehende Kenntnisse in Linux-Interna (Kernel-Tuning, Memory Management) und Networking (TCP/IP, CNI, Load Balancer, eBPF).
  • Du bringst Erfahrung im Betrieb von Datastores (z.B. PostgreSQL, Redis) und Messaging-Systemen (z.B. Kafka, NATS) in skalierbaren Umgebungen mit.
  • Du gehst Problemen auf den Grund, um daraus zu lernen, automatisierst dich selbst aus dem Job und verlässt dich nicht auf das Prinzip Hoffnung.
Einleitungstext

Schwarz Digits schafft das technologische Fundament für digitale Entscheidungsfreiheit in Europa. Als IT- und Digitalsparte der Schwarz Gruppe entwickeln und verantworten wir einerseits die IT-Infrastrukturen für die Handelssparten Lidl und Kaufland sowie die Schwarz Produktion und PreZero. Gleichzeitig agieren wir als unabhängiger Anbieter am externen Markt, um Unternehmen in ganz Europa bei ihrer digitalen Transformation zu unterstützen. Unsere Kernleistungen bündeln wir in den Bereichen Cloud, Cyber Security, Data & AI, Communication und Workspace. Trage auch du zur digitalen Entscheidungsfreiheit in Europa bei.
Bei uns arbeitest du an der Schnittstelle zwischen Agilität und Sicherheit: Du profitierst von den schnellen Entscheidungswegen, genießt echte Gestaltungsspielräume in deinen Projekten und baust dabei auf das stabile Fundament der Schwarz Gruppe.

Deine Aufgaben
  • Du arbeitest eng mit den Entwicklungsteams zusammen, um die “Time-to-Detect” zu verkürzen, indem du unsere Monitoring- und Alerting-Infrastruktur verbesserst und die Einhaltung der SLOs sicherstellst.
  • Deine Arbeit ist entscheidend für die kontinuierliche Optimierung der „Time-to-Mitigation“; dies erreichst du durch das Erstellen klarer Playbooks, das Design von Dashboards für First Responder und die Sicherstellung umfassender Telemetriedaten (Logs und Metriken).
  • Du agierst als Reliability Consultant für die Entwicklungsteams, vermittelst Wissen über Reliability-Patterns und unterstützt den „Shift Left“-Ansatz, um ein Modell der geteilten Verantwortung zu etablieren.
  • Du gestaltest und optimierst Entwicklungsprozesse wie CI/CD-Pipelines, um Progressive-Delivery-Strategien (z. B. Canary Releases und Blue/Green Deployments) zu unterstützen und Updates sicher und risikoarm auszurollen.
  • Du analysierst proaktiv die Skalierbarkeit der Control Plane und behebst Engpässe in Bereichen wie Distributed Consensus, Datenbank-Durchsatz und Kernel-Level-Networking.
  • Du nimmst an einer vergüteten On-Call-Rotation teil, leitest Incident Responses und moderierst Post-Mortems sowie Root Cause Analysen.
Benefits
  • Ein unabhängiges Europa - digital, führend. Wenn diese Vision dich genauso begeistert wie uns, lass uns die souveräne Cloud dafür gemeinsam bauen.
  • Du wirst Teil der führenden Handelsgruppe Europas, der Schwarz Gruppe und gehörst dabei zur IT- und Digitalsparte, Schwarz Digits. Damit profitierst du von der Dynamik eines jungen Unternehmens und der Stärke der etablierten Unternehmensgruppe, die hinter Lidl und Kaufland steckt.
  • Deine Ideen hören wir gerne - und das auf allen Ebenen: Duz-Kultur und offene Türen gestalten die Arbeit abwechslungsreich und produktiv. Dabei fördern wir den Blick über den Tellerrand und die Zusammenarbeit in agilen Strukturen, um gemeinsam innovative Lösungen zu entwickeln.
  • Du wirst Teil eines internationalen Teams, denn wir kommen aus aller Welt und bilden eine echte Einheit. Wir lieben und leben die Cloud. Jeder bringt seine eigenen Stärken ein, und gemeinsam verbessern wir kontinuierlich unser Portfolio.
  • Du wirst attraktiv entlohnt, genießt 30 Tage Urlaub, bist zeitlich und örtlich flexibel und profitierst von einer Vielzahl an starken Sport-, Mobilitäts- und Gesundheitsangeboten. Darüber hinaus fördern wir deine persönliche und berufliche Entwicklung mit individuellen Weiterbildungsmöglichkeiten. Zusätzlich erhältst du einen Dienstwagen zur privaten Nutzung inkl. Tankkarte.
  • Unsere Cloud-Lösungen basieren auf Open-Source-Technologien, wodurch wir offene Standards in der Cloud-Entwicklung fördern. xsxvtuf Bei uns kannst du dich auf innovative Denkansätze, eine unterstützende Community und eine moderne IT-Ausstattung verlassen.

Get similar jobs in Germany by email

We'll email you when new jobs similar to this one appear.

Similar jobs

Explore more DevOps Engineer jobs in Germany.

No similar openings right now. Refine your search or create an alert above.