Operations Engineer (m/w/d)

Berlin
Start: 01.10.2026
il y a 4 jours
Job Typ:
Festanstellung
Arbeitsumfang:
Vollzeit

ID: 180044

Appliquer ici

Westhouse ist eines der führenden Recruitment-Unternehmen für die Vermittlung hochqualifizierter Fachexperten aus dem gesamten IT-Lifecycle- und Engineering-Bereich.

Für unseren Kunden suchen wir aktuell eine/n Operations Engineer (m/w/d) - Berlin.

Ihre Aufgaben

    • Verantwortung für gemeldete Kundenprobleme und Verfolgung dieser bis zur Lösung,
    • Untersuchung, Diagnose und Ermittlung von Lösungen zur Behebung von Problemen in den Services
    • Einhaltung der vorgegebenen Prozesse für die Eskalation von ungelösten Problemen an die zuständigen internen Teams
    • Überwachung und Einhaltung der SLO-Alarme und Fehlerbudgets
    • Management des Incident-Response-Flows
    • Identifizierung und Implementierung von Automatisierungsmöglichkeiten
    • Bearbeitung und Lösung offener Support-Tickets unter Einhaltung der SLAs
    • Koordination mit unterschiedlichen Stakeholdern zur Durchführung von blameless Post Mortems

Interessiert?

Justus von Lenthe

Tel.: +49-40-3176773917
Fax.: +49-40-99996799
Email: j.lenthe@westhouse-consulting.com

Appliquer ici


Ihre Qualifikationen

    • Erfolgreich abgeschlossenes Studium mit Schwerpunkt Informatik, eine abgeschlossene Ausbildung im IT-Bereich oder eine gleichwertige Qualifikation
    • mehrjährige (mindestens 3 Jahre) Erfahrungen im IT-Betrieb oder Produktionssupport
    • fundierte Erfahrung mit Systemadministrationsaufgaben
    • fundierte Erfahrung mit Linux-Plattformen
    • ITIL-Grundkenntnisse,
    • sehr gute Deutsch-Kenntnisse (C1) in Wort und Schrift,
    • Englisch-Kenntnisse (B2).
    • Mindestens 3 Jahre relevante Erfahrung im Support (2nd-3rd Level) oder Operations Tätigkeiten im Anwendungsbetrieb mit Kubernetes
    • Know-how im Umgang mit mindestens 3 Technologien: Kubernetes, Openshift, Docker, Postgres, Grafana, Prometheus, Gitlab, Terraform
    • Erfahrung in der Arbeit mit Services eines Hyperscaler wie AWS, Microsoft Azure oder Google Cloud Plattform
    • relevante Erfahrung im Umgang mit Jira und Confluence
    • Kenntnisse in mindestens einer der Programmiersprachen: Python, Bash Scripting, Go, Ruby, Perl oder anderen vergleichbaren
    • Selbstmanagement / Zuverlässigkeit / Zeitmanagement / Pünktlichkeit
    • Proaktive Risikoeinschätzung
    • Klarheit in der Krisenkommunikation: vermittelt technische Sachverhalte präzise
    • Teamfähigkeit, Flexibilität und die Bereitschaft in der Rufbereitschaft zu arbeiten
    • Fähigkeit zur professionellen Dokumentation und Transparenz in Arbeitsdokumentation (Tickets)
    • Fähigkeit, stressresistent und ruhig bei kritischen incidents zu bleiben
    • Proaktive Fehleranalyse: identifiziert und behebt Probleme, ggf. Eskalation einleiten und begleiten