Senior Platform Engineer (Schwerpunkt Kafka) (m/w/d)
- Remote (90%) / Reisebereitschaft (10%)
- Start: 03.08.2026 (ASAP)
- vor 1 Woche
- Job Typ:
- Projekt
- Dauer:
- bis 28.02.2027 + Option
- Arbeitsumfang:
- Vollzeit - (100%)
- Sprachen:
- Deutsch
ID: 179468
Westhouse ist eines der führenden internationalen Recruitment Unternehmen für die Vermittlung von hochqualifizierten Fachexperten in Bereichen wie IT Life Cycle, SAP, Engineering, Kaufmännischem und Fachberatung.
Für unseren Kunden suchen wir aktuell eine/n Senior Platform Engineer (Schwerpunkt Kafka) (m/w/d) - Remote (90%) / Reisebereitschaft (10%).
Ihre Aufgaben
- Design, Bereitstellung und Betrieb von skalierbaren Kafka‑Clustern (on‑prem, Azure, OpenShift)
- Konfiguration und Wartung von Kafka‑Komponenten (Broker, Connect, ksqlDB, Schema Registry, MirrorMaker)
- Implementierung von Sicherheits‑ und Authentifizierungsmechanismen (TLS, SASL, ACLs, Kerberos)
- Monitoring, Log‑Analyse und Performance‑Tuning (Prometheus, Grafana, JMX, Kafka‑Metrics)
- Incident‑Management: Fehlerdiagnose, Root‑Cause‑Analysis, Wiederherstellung und Post‑Mortem‑Berichte
- Automatisierung von Deployments und Konfigurationen mittels IaC & GitOps‑Workflows
- Planung und Durchführung von Kapazitäts‑ und Kosten‑Optimierungsmaßnahmen (Partition‑Strategien, Tiered Storage, Dynamic Scaling)
- Erstellung von Dokumentation, Best‑Practice‑Guides und Schulungen für Entwickler und Betriebsteams
Stellenanzeige teilen
Ihre Qualifikationen
- Muss:
- Tiefgehende Expertise in Apache Kafka / Confluent Kafka (Broker‑Installation, Cluster‑Setup, Topic‑Management, Partitioning, Replication, Quotas, ACLs)
- Erfahrung mit Kafka‑Connect, ksqlDB / Kafka Streams, Schema Registry
- Monitoring & Performance‑Tuning (JMX‑Metriken, Prometheus, Grafana, Kafka‑Metrics)
- Fehlerdiagnose & Incident‑Response in einer produktiven Kafka‑Umgebung
- Grundlegende Kenntnisse in Kubernetes/OpenShift (Deployment von Kafka‑Clustern in Container‑Umgebungen)
- Sicheres Verständnis von Netzwerk‑ und Sicherheitskonzepten (TLS/SSL, Kerberos, SASL)
- Idealerweise:
- Erfahrung mit GitOps‑Automatisierung (ArgoCD/Flux, Helm‑Charts, CRDs) für Kafka‑Deployment
- Infrastruktur‑as‑Code (IaC) mit Terraform für Azure / Kubernetes‑Ressourcen
- Kenntnisse in Hybrid‑Cloud‑Umgebungen (Azure + On‑Prem) und deren Netzwerkintegration
- Erfahrung mit Container‑Security‑Frameworks (OPA, Kyverno, Image‑Scanning)
- Praktische Umsetzung von Disaster‑Recovery‑ und HA‑Strategien (Raft‑Mode, Zookeeper‑Free, MirrorMaker)
- Optimierung von Kafka‑Kosten und Kapazitäten (Dynamic Scaling, Tiered Storage)