GPU AI HPC DevOps Engineer
Summary
Design, deploy, and manage large-scale GPU clusters for AI/ML workloads across on-prem and cloud environments, automate provisioning, and implement CI/CD pipelines.
Singtel Digital InfraCo’s RE:AI division is building Asia’s most advanced AI infrastructure. As a DevOps Engineer for SingTel’s GPUaaS, you will design, deploy and manage large-scale GPU clusters for AI and ML workloads across on-prem and cloud environments.
You will implement CI/CD pipelines, automate provisioning, and monitor system health and performance. Collaboration with software teams to streamline workflows and provide user support is essential.