Sre / devops sênior
Summary
The Senior SRE/DevOps engineer will manage and optimize infrastructure, focusing on performance, stability, and cost-efficiency using tools like Kubernetes, AWS, and various automation frameworks. The role involves maintaining CI/CD pipelines, monitoring production environments, and collaborating with development teams to improve system reliability.
Você e suas habilidades são bem-vindas aqui!
Experiência e Conhecimento Técnico
- Infraestrutura como Código (IaC)
- Domínio de Terraform, Pulumi ou CloudFormation para provisionamento de infraestrutura.
- Experiência com módulos reutilizáveis e boas práticas de versionamento.
- Kubernetes e Orquestração de Containers
- Gerenciamento avançado de Kubernetes (EKS, OVH).
- Domínio de Helm Charts, Kustomize, Kubernetes Federation ou Karmada.
- Experiência com policy enforcement (OPA/Gatekeeper).
- Cloud Computing
- Domínio de AWS, OVH.
- Prática com serviços como EC2, RDS, EKS, S3, VPC, IAM e cost management.
- Experiência com Auto Scaling Groups (ASG), Spot Instances e Load Balancers.
- Observabilidade (Monitoring, Logging, Tracing)
- Configuração e gestão de Prometheus, Grafana, Alertmanager, Loki.
- Experiência com distributed tracing (Jaeger ou OpenTelemetry).
- Criação de alertas eficientes para SLOs e SLAs.
- Pipelines e Automação (CI/CD)
- Experiência com Bitbucket Pipelines, Jenkins.
- Configuração de deploys para EKS, Swarm, VMs.
- Conhecimento em progressive delivery (Canary, Blue-Green, Feature Flags).
- Gerenciamento de Configuração
- Domínio de Ansible, Chef ou Puppet.
- Experiência com Secrets Management (AWS Secrets Manager, HashiCorp Vault).
- Redes e Segurança
- Experiência com VPC, VPN, Security Groups, Firewalls, WAF.
- Hardening de Kubernetes, configuração de RBAC e controle de acesso (IAM).
- Conhecimento em mTLS, OIDC, OAuth2, JWT ou SSO.
- Banco de Dados e Storage
- Experiência com RDS (MySQL, PostgreSQL, Aurora) e NoSQL (MongoDB e Redis).
- Gerenciamento de backups, replicação, failover.
- Troubleshooting de performance (análise de slow queries, locks, deadlocks).
- Shell Scripting e Linguagens de Automação
- Domínio de Bash, Python, Go ou Ruby.
- Experiência com API REST, Webhooks, JSON/YAML para automação.
Mentalidade
- Pensamento Estratégico e Proatividade
- Identificar pontos de falha na infraestrutura e propor melhorias.
- Capacidade de antecipar problemas e implementar soluções antes que afetem produção.
- Resolução de Problemas e Troubleshooting
- Habilidade para investigar logs, métricas e traces de forma eficiente.
- Experiência com war rooms, incidentes e post-mortems.
- Cultura de Engenharia de Confiabilidade (SRE)
- Definição de SLOs, SLIs e SLAs.
- Práticas de Chaos Engineering (Gremlin, LitmusChaos).
- Automação de tarefas para reduzir toil (trabalho manual repetitivo).
- Trabalho em Equipe e Comunicação
- Boa comunicação com times de desenvolvimento, segurança e infraestrutura.
- Capacidade de documentar processos.
- Participação ativa em incidentes, propondo soluções e melhorias.
Experiência Necessária
- Mínimo de 6-8 anos atuando em SRE/DevOps.
- Experiência com ambientes complexos, alta disponibilidade, grandes workloads.
- Histórico de participação em migrações de infraestrutura, otimização de custos e performance.
- Experiência liderando projetos de automação, arquitetura ou melhorias em sistemas produtivos.Inglês técnico para leitura
- Experiência em Linux
- Experiência com base de dados relacional e não relacional (MySQL e MongoDB)
- Experiência com Docker
- CI/CD, Jenkins, Git
- AWS
- Apache Kafka
- Docker Swarm e/ou Kubernetes
- Redis
- Experiência em aplicações distribuídas/multithreading
- Experiência em análise de performance e otimização de algoritmos e SQLPontos Bônus para a vaga de SRE DevOps - Sênior
- Experiência em auto scaling de aplicações
Pontos Bônus para a vaga
- Experiência sólida com Java 8 ou versão mais recente
- Experiência em Spring Framework/Spring Boot
- Experiência em Hibernate
Seu dia a dia será...
- Trabalhe junto com nosso time de ambiente, sugerindo novas tecnologias ou até ajustes na atual plataforma
- Foco em desempenho e estabilidade de toda a solução em produção
- Participe da criação de novos ambientes para novas soluções
- Análise a atual plataforma para sugerir novas abordagens que traga ganhos em desempenho, estabilidade ou custo
- Análise constante para possíveis reduções de custo das soluções da Segware