Analista de Monitoramento (NOC) - Sênior
Buscamos um profissional
com sólida experiência em operação NOC, domínio técnico de Zabbix e Grafana e autonomia para liderar análises complexas, orientar o time e evoluir ambientes de monitoramento críticos de provedores e operadoras.
Sobre o NIIS - Porque fazer parte?
O NIIS (Network Intelligence & Infrastructure Services), atua com monitoramento, gerenciamento, suporte avançado, arquitetura e melhoria de redes de telecomunicações. Nosso NOC e CGR atende ambientes reais e críticos de provedores, operadoras e empresas, utilizando tecnologias como Zabbix, Grafana e diversos softwares próprios para transformar métricas e alarmes em ações que aumentam a disponibilidade, estabilidade e a qualidade das redes dos nossos clientes.
Fazer parte do NIIS é ter contato com diferentes fabricantes, tecnologias e topologias de rede, em um ambiente que incentiva o aprendizado e o crescimento contínuo. Oferecemos acompanhamento técnico, recursos para desenvolvimento profissional, e apoio financeiro para certificações relevantes à função.
Principais responsabilidades
- Monitorar a disponibilidade, o desempenho e a capacidade de ativos, enlaces e serviços críticos de rede;
- Liderar a análise e a correlação de alarmes, eventos, métricas e indicadores, especialmente em incidentes de maior impacto ou complexidade;
- Conduzir triagens, diagnósticos e escalonamentos técnicos, identificando causas prováveis, impactos, prioridades e ações de contenção;
- Executar troubleshooting avançado de conectividade, infraestrutura, coleta e serviços de monitoramento;
- Projetar, configurar e manter hosts, templates, itens, preprocessamentos, triggers, macros, discovery rules, actions, correlação de eventos e mapas no Zabbix;
- Criar, padronizar e evoluir dashboards, variáveis, datasources, transformações e alertas no Grafana;
- Investigar e solucionar falhas de coleta via SNMP, ICMP, agentes, Syslog, APIs, proxies e outros métodos de integração;
- Definir e revisar thresholds, dependências, severidades e regras de supressão, reduzindo ruídos e aumentando a assertividade dos alarmes;
- Analisar tendências de capacidade e disponibilidade, antecipando riscos, saturações e degradações de desempenho;
- Conduzir análises de causa raiz e gestão de problemas, propondo ações corretivas e preventivas;
- Garantir registros, escalonamentos e comunicações técnicas claras, respeitando SLAs e fluxos definidos;
- Atuar como referência técnica para analistas menos experientes, realizando revisões, orientações e compartilhamento de conhecimento;
- Definir padrões, documentar procedimentos e soluções e contribuir para o roadmap de evolução do monitoramento e da operação NOC.
Conhecimentos necessários
- Experiência avançada com Zabbix em ambientes de produção;
- Domínio de arquitetura distribuída, proxies, templates, itens, preprocessamento, LLD, triggers, dependências, correlação de eventos, macros e actions;
- Experiência avançada com Grafana, incluindo datasources, variáveis, transformações, alertas e construção de dashboards executivos e operacionais;
- Conhecimento de protocolos e métodos de monitoramento, como SNMPv2c, ICMP, agentes, Syslog, APIs e webhooks;
- Conhecimento sólido de redes TCP/IP, endereçamento, DNS, VLANs, switching, roteamento, latência, perda de pacotes e disponibilidade;
- Capacidade de interpretar métricas e correlacionar eventos, tendências e indicadores de capacidade;
- Domínio de ferramentas de diagnóstico como ping, traceroute, MTR, dig, curl e tcpdump;
- Conhecimento de Linux para análise de serviços, logs, processos, recursos e falhas de integração;
- Vivência com gestão de incidentes e problemas, escalonamento técnico, SLA e atuação em regime de escala.
Será um diferencial
- Experiência em NOC de provedores de internet, operadoras ou empresas de telecomunicações;
- Conhecimento de switches, roteadores, firewalls, servidores, enlaces, OLTs, BRAS/BNGs e CGNATs;
- Experiência com alta disponibilidade, performance, proxies e bancos de dados em ambientes Zabbix;
- Conhecimento de outras tecnologias de observabilidade, como Prometheus, InfluxDB ou Elastic Stack;
- Certificações em Zabbix, Grafana, redes e Linux.
Perfil que buscamos
- Postura de referência técnica, com colaboração e disposição para desenvolver o time;
- Autonomia para tomar decisões técnicas e conduzir incidentes críticos até a estabilização;
- Raciocínio analítico, visão sistêmica e capacidade de priorizar em cenários complexos;
- Equilíbrio, responsabilidade e comunicação objetiva durante situações de alta criticidade;
- Proatividade para antecipar riscos, propor melhorias e assumir a evolução das soluções;
- Facilidade para compartilhar conhecimento e se comunicar com equipes técnicas, clientes, operadoras e fornecedores.
Experiência necessária
- Experiência sólida e comprovada em monitoramento, infraestrutura ou operação NOC, com atuação em incidentes críticos e ambientes de alta disponibilidade;
- Domínio prático de Zabbix e Grafana, incluindo configuração, troubleshooting e evolução de ambientes de produção.