Exploitant RunOps confirmé

Summary

Oversee and maintain production applications and infrastructure, ensuring reliability and performance through monitoring, incident management, and automation in cloud and data environments.

📌 Missions principales

  • Maintien en conditions opĂ©rationnelles : assurer la disponibilitĂ©, la performance et la fiabilitĂ© des applications et infrastructures en production.

  • Supervision et monitoring : mettre en place et suivre les outils de supervision, gĂ©rer les alertes et incidents.

  • Gestion des incidents : diagnostic, rĂ©solution, escalade N2/N3, suivi des RCA (Root Cause Analysis).

  • Industrialisation et automatisation : participation aux dĂ©ploiements CI/CD, scripting (Python, Shell, PowerShell), Ansible.

  • Cloud et Data : exploitation d’environnements GCP/Azure, gestion de pipelines Big Data (Kafka, Hadoop, Spark).

  • AmĂ©lioration continue : optimisation des processus, contribution aux bonnes pratiques DevOps/ITIL.

🧠 Compétences techniques

  • Systèmes : Linux, Windows Server.

  • Cloud : GCP, Azure, Kubernetes (dĂ©ploiement applicatif, optimisation).

  • Data : Kafka, Hadoop, Spark Streaming.

  • Automatisation : Ansible, Terraform, scripting (Python, Shell).

  • Supervision : outils de monitoring (Prometheus, Grafana, ELK).

  • ITIL : gestion des incidents, problèmes et changements.