CONSULTOR SRE
Summary
SRE consultant at Vivo (Telefônica) in São Paulo: acts as technical reference for reliability, critical incident response and observability across multicloud, while driving AIOps and generative-AI agents for operations. Core: SRE practices (SLI/SLO, error budget), monitoring tools (Dynatrace, Datadog, Splunk), OpenTelemetry, cloud and automation.
VP: TI
Diretoria: Infraestrutura e Operações de TI
Area: Infraestrutura e Cloud - Command Center TI
A missão da Diretoria de Infraestrutura e Operações de TI é assegurar o funcionamento, assistência e suporte técnico especializado na infraestrutura e soluções de TI responsáveis pelo suporte ao negócio baseando-se nos direcionadores:
- Ter atendimento voltado a necessidade do negócio;
- Equilibrar estabilidade e agilidade;
- Monitorar e medir serviço sob a perspectiva de negócio;
- Ser uma operação preditiva;
- Ter processos simples e eficientes;
- Pessoas certas nos lugares certos;
- Gestão por indicadores.
Dentro do contexto da Diretoria, a Gerencia de Produção do Command Center é responsável por:
- Monitoração de Eventos;
- Processo de melhoria e evolução de gestão de Eventos;
- Incidentes de Infraestrutura;
- Incidentes de Negócio Major;
- Evolução AIOps.
Estamos em busca de um Consultor com forte habilidade em liderança técnica, troubleshooting avançado e visão de confiabilidade, capaz de atuar tanto em sistemas corporativos críticos quanto em soluções modernas de IA e agentes inteligentes.
Missão do Papel
Atuar como referência técnica em confiabilidade, suporte à produção e excelência operacional, conectando as disciplinas de SRE, Observabilidade, Automação e Inteligência Artificial para garantir a estabilidade, disponibilidade e evolução contínua de serviços críticos.
Esse profissional será responsável por liderar a resolução de incidentes complexos, acelerar a identificação de causas raiz, promover a adoção de práticas modernas de engenharia e impulsionar o uso de IA aplicada às operações, transformando dados operacionais em ações concretas para melhoria da experiência dos clientes e da eficiência dos times.
Responsabilidades
Confiabilidade e Suporte à Produção
- Atuar como referência técnica para equipes de Suporte à Produção, Observabilidade, Hub de Eventos e integrações no ecossistemas modernos em multicloud, MCPs, fabricas de agentes e IA generativa.
- Liderar tecnicamente a resposta a incidentes críticos, coordenando equipes multidisciplinares na definição de estratégias de mitigação e solução definitiva.
- Conduzir análises de causa raiz (RCA), post-mortems e planos de ação, garantindo sua execução e acompanhamento.
- Identificar oportunidades de redução de falhas recorrentes, aumento da disponibilidade e melhoria contínua dos serviços.
- Elaborar e comunicar análises técnicas e executivas para diferentes níveis da organização.
SRE, Observabilidade e Operações Inteligentes
- Evoluir processos de monitoração, observabilidade e gestão de incidentes utilizando práticas de SRE, ITIL, AIOps e Engenharia de Confiabilidade.
- Definir, implementar e acompanhar indicadores de confiabilidade como SLI, SLO, Error Budget, MTTD, MTTR e métricas de experiência dos serviços.
- Apoiar a construção e evolução de dashboards, painéis operacionais e indicadores para ambientes produtivos e não produtivos.
- Garantir a adoção de padrões operacionais, automações e controles de conformidade alinhados às políticas corporativas.
- Atuar na implementação e evolução de ferramentas de monitoração, observabilidade, automação e ITOM.
Inteligência Artificial Aplicada à Operação
- Utilizar IA, copilots, agentes inteligentes e automação avançada para acelerar análises, diagnósticos e tomadas de decisão.
- Contribuir para a integração de modelos de IA e agentes com plataformas corporativas de observabilidade, eventos e operação.
- Apoiar iniciativas de AIOps e automação inteligente voltadas para prevenção, detecção e remediação de incidentes.
- Disseminar o uso responsável de IA como acelerador de produtividade, confiabilidade e eficiência operacional.
Liderança Técnica e Transformação
- Influenciar e orientar equipes multidisciplinares na adoção de práticas modernas de engenharia e operação.
- Participar da definição e acompanhamento de OKRs, KPIs e indicadores estratégicos.
- Atuar como agente de transformação cultural, promovendo automação, excelência operacional, colaboração e aprendizado contínuo.
- Colaborar com áreas internas, times de engenharia, arquitetura, operações e fornecedores para garantir a evolução sustentável das plataformas.
Formação:
- Desejável Formação superior em Tecnologia da Informação, Engenharia, Ciência da Computação, Matemática, Administração ou áreas correlatas.
Conhecimentos Técnicos:
- Sólida experiência em troubleshooting avançado e análise de causa raiz (RCA).
- Experiência com operações de ambientes críticos de alta disponibilidade.
- Conhecimento prático em SRE, Engenharia de Confiabilidade e Gestão de Incidentes.
- Experiência com observabilidade moderna, incluindo métricas, logs, traces, OpenTelemetry e dashboards operacionais.
- Vivência na definição e acompanhamento de SLI, SLO, Error Budget, MTTD e MTTR.
- Experiência com ferramentas de monitoração e observabilidade como Dynatrace, Datadog, Elastic, Splunk, Zabbix ou similares.
- Conhecimento em ambientes de nuvem pública, privada ou híbrida.
- Experiência com automação operacional, pipelines e integração de ferramentas.
- Conhecimento dos fundamentos de IA Generativa, LLMs, agentes inteligentes, governança e ciclo de vida de modelos.
Competências Comportamentais:
- Forte capacidade analítica e pensamento sistêmico.
- Perfil "hands-on", com habilidade para atuar em cenários de alta pressão e criticidade.
- Excelente comunicação técnica e executiva.
- Capacidade de influenciar e liderar tecnicamente equipes multidisciplinares.
- Orientação a resultado, melhoria contínua e experiência do cliente.
- Mentalidade de aprendizado contínuo e adoção de novas tecnologias.
Diferenciais:
- Experiência em ambientes de Telecomunicações, Financeiro ou ecossistemas digitais de grande escala.
- Vivência em práticas Agile, DevOps e CI/CD.
- Conhecimento em AIOps e automação inteligente aplicada a operações.
- Experiência com Docker, Kubernetes e arquiteturas baseadas em microsserviços.
- Conhecimento em linguagens como Python, Go, Java, C#, Shell Script ou similares.
- Experiência com ferramentas de automação e configuração, como Ansible, Chef, Puppet ou equivalentes.
- Familiaridade com ServiceNow, ITOM e plataformas de gestão operacional.
- Experiência com definição e gestão de OKRs e KPIs.
- Certificações relacionadas a Cloud, SRE, DevOps, Observabilidade, ITIL, IA ou tecnologias correlatas.
- Histórico de utilização prática de IA para aceleração de diagnósticos, automação operacional e aumento de produtividade técnica.
Veja o que ofereceremos para você: Na Vivo não medimos esforços em apoiar e valorizar nossos colaboradores. Não são apenas excelentes benefícios, mas também flexíveis. • Escolher o benefício ideal para você e seus dependentes, numa plataforma digital com diversas categorias de Academia, VR, VA, Auxílio Farmácia, Assistência Médica, Odontológica e Seguro de Vida; • Celular corporativo. Sim, um smartphone novinho para você! • Plano de voz e Dados ilimitado! Sim ilimitado! Com a melhor rede móvel, ainda mais rápida com o 5G da Vivo! • Uma oferta exclusiva da Vivo, com desconto especial em linha fixa, banda larga, TV e apps; • Terá direito a receber Bônus ou PPR anual; • Planejará seu futuro através do plano de Previdência Privada; • Tem filhos? Terá direito a um subsídio para ajudar nas despesas com escola, creche ou babá; • Viver em um ambiente que respeitará sua personalidade, seu estilo de se vestir, seu jeito de ser e poderá ser autêntico. #VemdeVocê • Trabalhar remotamente até 2 vezes por semana. #Mobility • Ter flexibilidade de horário; • Aproveitar um dia de folga (Day off) para comemorar seu aniversário; • Participar de um dos maiores programas de voluntariado corporativo para você transformar o mundo; • Usufruir do nosso Programa de Desenvolvimento Educacional que oferece parcerias em instituições de ensino com desconto; certificações e cursos online. • Potencializar sua carreira por meio do nosso Programa de Recrutamento Interno, no Brasil ou fora, afinal estamos presentes em mais de 17 países! #VivoMinhaCarreira • Contar com uma série de iniciativas para melhorar a sua saúde física, emocional e social! Por aqui, temos o #VivoBemEstar, que estimula o nosso time a ter hábitos saudáveis e mais qualidade de vida! Disponibilizados aos nossos colaboradores consultas com nutricionista, psicólogos, serviço social, telemedicina, e muito mais! • Todas as nossas vagas são elegíveis a pessoas com deficiência e/ou reabilitados. Temos uma cultura que valoriza a diversidade, as diferenças e o potencial das pessoas! #VivoDiversidade #VemPraVivo Importante: A única forma de participar de processos seletivos da Vivo é por meio das páginas da empresa na plataforma Gupy https://vivo.gupy.io e não há pagamento de taxa de participação ou contratação.