Infrastructure Support Engineer / SRE / Cloud Operations Engineer
Summary
Maintains cloud infrastructure and production systems, troubleshooting incidents and monitoring performance using tools like Datadog, Grafana, and Prometheus for a tech company.
Position Overview Role: Infrastructure Support Engineer / SRE / Cloud Operations Engineer Location: Sunnyvale, CA / San Jose, CA (Onsite / In-Person Interview) Duration: Long Term Experience Level: 10 Years Overall Experience Key Responsibilities Production Operations & Monitoring: Monitor enterprise production environments using tools such as Datadog, Grafana, Prometheus, New Relic, or Splunk. Incident & Outage Management: Lead triaging, escalation, and resolution for Sev1, Sev2, and Sev3 inci…