Exploitant RunOps confirmé
Summary
Oversee and maintain production applications and infrastructure, ensuring reliability and performance through monitoring, incident management, and automation in cloud and data environments.
📌 Missions principales
Maintien en conditions opérationnelles : assurer la disponibilité, la performance et la fiabilité des applications et infrastructures en production.
Supervision et monitoring : mettre en place et suivre les outils de supervision, gérer les alertes et incidents.
Gestion des incidents : diagnostic, résolution, escalade N2/N3, suivi des RCA (Root Cause Analysis).
Industrialisation et automatisation : participation aux déploiements CI/CD, scripting (Python, Shell, PowerShell), Ansible.
Cloud et Data : exploitation d’environnements GCP/Azure, gestion de pipelines Big Data (Kafka, Hadoop, Spark).
Amélioration continue : optimisation des processus, contribution aux bonnes pratiques DevOps/ITIL.
🧠Compétences techniques
Systèmes : Linux, Windows Server.
Cloud : GCP, Azure, Kubernetes (déploiement applicatif, optimisation).
Data : Kafka, Hadoop, Spark Streaming.
Automatisation : Ansible, Terraform, scripting (Python, Shell).
Supervision : outils de monitoring (Prometheus, Grafana, ELK).
ITIL : gestion des incidents, problèmes et changements.