DevOps & Infrastructure Engineer (m/w/d)
othermo DevOps & Infrastructure Engineer (m/w/d)
Du übernimmst Verantwortung für Betrieb und Weiterentwicklung unserer Services und Infrastruktur, baust Monitoring aus und sorgst gemeinsam mit dem Team dafür, dass unsere IoT-Plattform stabil, sicher und skalierbar läuft.
Als DevOps & Infrastructure Engineer sorgst du gemeinsam mit dem Platform-&-Infrastructure-Team dafür, dass unsere IoT-Plattform stabil, sicher und skalierbar läuft. Du entwickelst unsere Ansible-basierte Server-Infrastruktur bei Hetzner und OVH weiter, automatisierst Deployment-Prozesse und schaffst mit Monitoring, Alerting und Logging Transparenz im Betrieb.
Dein Fokus liegt auf dem Betrieb und der Weiterentwicklung unserer internen und kundengerichteten Services, vom Deployment über die Verfügbarkeit bis zum Ausbau unserer Airflow-Instanzen. Du arbeitest eng mit den Backend- und Embedded-Teams zusammen, bist Sparringpartner bei Architektur-Entscheidungen und Code-Reviews und übernimmst im Incident-Fall Verantwortung für eine schnelle Stabilisierung und nachhaltige Ursachenbehebung.
Dein Fokus liegt auf dem Betrieb und der Weiterentwicklung unserer internen und kundengerichteten Services, vom Deployment über die Verfügbarkeit bis zum Ausbau unserer Airflow-Instanzen. Du arbeitest eng mit den Backend- und Embedded-Teams zusammen, bist Sparringpartner bei Architektur-Entscheidungen und Code-Reviews und übernimmst im Incident-Fall Verantwortung für eine schnelle Stabilisierung und nachhaltige Ursachenbehebung.
- Betrieb und Weiterentwicklung der Ansible-basierten Server-Infrastruktur bei Hetzner und OVH
- Ausbau und Pflege von Monitoring, Alerting und zentralem Logging, einschließlich Grafana-Dashboards
- Verantwortung für den Betrieb und die Weiterentwicklung unserer internen und kundengerichteten Services, inklusive Deployment-Automatisierung, CI/CD-Pipelines, Monitoring und Sicherstellung der Verfügbarkeit
- Pflege der Container-Infrastruktur durch aktuelle und sichere Base Images, standardisierte Build-Prozesse und saubere Registries (Docker/Podman)
- Erweiterung und Betrieb unserer Airflow-Instanzen, inklusive Monitoring, Alerting und Performance Optimierung
- Enge Zusammenarbeit mit den Backend- und Embedded-Teams bei Architektur-Entscheidungen, Code-Reviews und Troubleshooting
- Dokumentation von Konfigurationen, Betriebsabläufen und Incident-Erkenntnissen sowie Etablierung nachvollziehbarer und reproduzierbarer Standards
- Gute praktische Erfahrung in der Administration und im Betrieb von Linux-Systemen, idealerweise in Fedora- oder RHEL-basierten Umgebungen
- Sicherer Umgang mit Ansible, insbesondere mit Rollen, Vault und Inventories
- Erfahrung mit dem Betrieb produktiver Anwendungen, einschließlich Monitoring, Alerting und Incident-Response
- Routine im Umgang mit Docker oder Podman sowie Container-Builds und Registries
- Strukturierte Analyse technischer Probleme, risikobewusstes Vorgehen und nachvollziehbare sowie reproduzierbare Dokumentation von Änderungen
- Verantwortungsbewusstes, ruhiges und lösungsorientiertes Handeln in Störungssituationen sowie verbindliche Kommunikation von Risiken und Abhängigkeiten
- Sprache: Deutsch C1, Englisch B2.
Wir verbinden Technologie mit echtem Kundennutzen und setzen auf pragmatische Lösungen statt Buzzwords. Bei othermo arbeitest du in einem Umfeld, in dem deine Ideen gehört werden, dein Beitrag zählt und du direkt mitgestalten kannst, wie die Energiewende im Gebäudebestand gelingt.
- Verantwortung für eine produktive IoT-Infrastruktur mit eigenen Servern, realen Gateways und spürbarer Wirkung.
- Ein Team, das Infrastruktur als gemeinsame Aufgabe versteht und eng über Fachgrenzen hinweg zusammenarbeitet
- Klare Qualitätsstandards und ein direkter Austausch mit Engineering und Management
- Remote oder Hybrid in Alzenau möglich - flexibel gestaltbar.
- Optimale Ausstattung, Transparenz, kollegiales Miteinander sowie festes Budget zur Weiterbildung