Cloud Operations Engineer (w/m/d)
Wir suchen erfahrene Cloud Operations Ingenieure mit fundiertem Hintergrundwissen in Linux, Windows, Netzwerktechnik und Cloud-Umgebung, die unser Customer Operations Team verstärken möchten.
In unserem Team unterstützt du unsere Business- und Enterprise-Kunden bei der Problemanalyse und -lösung rund um unsere Infrastruktur. Von der Annahme von Störungsmeldungen über die Eingrenzung der Ursache bis hin zur Wiederherstellung des Betriebs liegt die gesamte Bearbeitungskette in deinen Händen. Dabei kommen dir deine Kundenorientierung und deine Lösungskompetenz zugute.
Wir arbeiten rund um die Uhr in drei Schichten. Du bist bereit, an der Schichtrotation teilzunehmen und entsprechend eingeplant zu werden. Da ein Teil unserer Arbeit sicherheitssensible Bereiche berührt, bringst du die Bereitschaft mit, ein erweitertes Sicherheitsüberprüfungsverfahren (SÜ2) zu durchlaufen. Unsere Kunden kommunizieren auf Deutsch und Englisch – du beherrschst beide Sprachen verhandlungssicher.
### Aufgabenbereich
- Zugleich Technischer Berater und Ops-Engineer an der Seite unserer Enterprise-Kunden in komplexen Umgebungen.
- Analyse von Kunden-Workloads, Debugging von komplexen Störungen, Erstellung dauerhafter Lösungen oder Workarounds.
- Automatisierung wiederkehrender Probleme/Aufgaben mittels Skripten und Tools (KI).
- Austausch mit Developer- und Sales Teams zur Steigerung von Qualität und Stabilität.
- Arbeit an sensiblen Umgebungen unter Sicherheits- und Compliance-Anforderungen.
- Monitoring der Cloud Infrastruktur und proaktives Handeln im Fehlerfall.
### Qualifikationen
- Mehrjährige Erfahrung im Betrieb von Cloud-Infrastrukturen, Linux, Netzwerken, Virtualisierung (Qemu / KVM), Containern (Kubernetes), Storage Systemen und Web Requests (APIs).
- Ausgeprägte „Customer-First“-Mentalität und hohe Lösungskompetenz.
- Begeisterung für Fehleranalyse (Logfiles, Traces, Metriken) und Troubleshooting.
- Fähigkeiten im Debugging von Netzwerken (LAN/WAN/VPN, DNS, DHCP).
- Kenntnisse von S3 und Storage-Systemen (File, Object, Block).
- Erfahrung mit gängigen Monitoring- und Alerting-Systemen (Prometheus, Grafana, OpsGenie, o.ä.).
- Kenntnisse gängiger Development- und Deployment-Tools (z.B. Bash, Python, Ansible, Terraform, Git).
- Erfahrung mit Ticket- und Dokumentations-Systemen (Jira, Confluence, o.ä.).
- Kenntnisse in Scripting und Softwareentwicklung idealerweise auch unter Einsatz von KI-Tools.
- Bereitschaft zur erweiterten Sicherheitsüberprüfung (SÜ2).
- Fließende Deutsch- und Englischkenntnisse.
### Benefits
- Hybrides Arbeitsmodell.
- Flexible Arbeitszeiten durch Vertrauensarbeitszeit.
- An einigen Standorten eine bezuschusste Kantine und verschiedene kostenfreie Getränke.
- Moderne Büroflächen mit sehr guter Verkehrsanbindung.
- Diverse Mitarbeiterrabatte für Aktivitäten und Produkte.
- Mitarbeiterevents wie Sommer- und Winterfeiern, sowie Workshops.
- Zahlreiche Weiterbildungs- und Entwicklungsmöglichkeiten.
- Verschiedene Gesundheitsangebote, wie Sport- und Gesundheitskurse.