Site Reliability Engineer (SRE) SR
Summary
The Site Reliability Engineer will ensure system availability, scalability, and performance by implementing observability practices and managing identity and access solutions. The role involves incident resolution, automation of operational tasks, and collaboration with development teams to foster a culture of reliability.
Você é apaixonado(a) por tecnologia e inovação?
💡 No Grupo SysMap – que reúne SysMap Solutions, TriggoLabs e triggo.ai – acreditamos que grandes resultados nascem de pessoas incríveis.
Somos uma empresa brasileira de tecnologia que, desde 1999, ajuda organizações a superar desafios complexos e acelerar sua transformação digital.
Nossa atuação abrange diversos segmentos, como Telecom, Varejo, Educação, Financeiro, Indústria/Cosméticos e Energia, sempre com foco em soluções inovadoras e de alto impacto.
👉 Candidate-se agora e construa o futuro da tecnologia conosco!
- Garantir a disponibilidade, escalabilidade e desempenho das aplicações e serviços;
- Implementar e evoluir práticas de observabilidade, incluindo métricas, logs e traces;
- Criar e manter dashboards (dashs) para acompanhamento de indicadores de saúde dos sistemas;
- Definir e gerenciar alarmísticas, com foco em alertas eficientes e redução de ruído;
- Atuar na identificação e resolução de incidentes, realizando análise de causa raiz (RCA);
- Trabalhar em conjunto com times de desenvolvimento para melhoria contínua (DevOps);
- Automatizar rotinas operacionais e processos de monitoração;
- Apoiar a definição e acompanhamento de SLIs, SLOs e SLAs;
- Contribuir para a cultura de confiabilidade e engenharia de resiliência.
- Experiência em Gestão de Identidades e Acessos (IAM);
- Conhecimento em soluções Ping Identity (diferencial importante);
- Conhecimento em Observabilidade, com experiência em plataformas como Datadog, Elastic e Grafana;
- Boa capacidade de comunicação, acompanhamento de demandas e interação com equipes multidisciplinares.