Summary
Senior/Lead Site Reliability Engineer focused on observability, working 100% remotely (8 years experience). The role centers on building and operating monitoring and tracing stacks — Splunk, ELK, Prometheus, Grafana, OpenTelemetry, distributed tracing — on Kubernetes/AWS infrastructure with Terraform, Kafka, and scripting in Python/Go/Bash.
Position - Senior/Lead Site Reliability Engineer Observability Location - 100% Remote Experience - 8 Years Type - Full Time Technology Stack - Splunk Enterprise, Splunk Cloud, Elasticsearch, ELK, Kibana, Prometheus, Grafana, Grafana Tempo, OpenTelemetry, Distributed Tracing, Kafka, Terraform, Kubernetes, Docker, Linux, Python, Go, Ruby, Bash, AWS, Ansible, Consul. Job Description - Must Have Technical/Functional Skills: 7 years in Site Reliability Engineering, Platform Engineering, or DevOps. H…