About this role
Como Analista DevOps Sênior, você terá um papel fundamental na construção e evolução de ambientes altamente resilientes, escaláveis e observáveis. Atuando com práticas avançadas de Site Reliability Engineering (SRE), automação e Cloud Computing, você será responsável por impulsionar a confiabilidade das plataformas, otimizar processos operacionais e garantir a excelência na entrega de soluções digitais. Esta posição é estratégica para apoiar iniciativas de transformação digital, promovendo automação, estabilidade operacional e melhoria contínua em ambientes de missão crítica.
Faça parte de uma equipe que combina inovação, engenharia de excelência e colaboração para construir soluções modernas em escala global. Aqui, você terá a oportunidade de trabalhar com tecnologias de ponta, participar de projetos desafiadores e contribuir diretamente para a evolução das melhores práticas de confiabilidade, automação e operação em cloud. Together we do what matters.
Saiba mais sobre alguns dos nossos benefícios:
• Vale refeição ou alimentação • Cartão Multibenefícios (até Consultor(a) Sênior) • Convênio médico e odontológico • Certificações e treinamentos • Seguro de vida • Previdência privada • Avababy: acompanhamento da gestação e kit para novos pais e mães • Participação nos resultados da empresa • Wellhub • Auxílio creche • Mentoria de carreira • Política de Birthday Off (um dia de folga no mês do seu aniversário) • Sessões de bem-estar • Para cargos gerenciais: veículo corporativo, estacionamento e auxílio combustível Responsabilidades
• Implementar e evoluir práticas de Site Reliability Engineering (SRE); • Administrar e otimizar ambientes Linux/Unix de alta criticidade; • Criar, manter e aprimorar pipelines de CI/CD; • Gerenciar ambientes conteinerizados utilizando Docker e Kubernetes; • Desenvolver e manter infraestrutura como código (IaC) utilizando Terraform, Pulumi ou ferramentas similares; • Implementar soluções de observabilidade utilizando métricas, logs e tracing; • Definir e acompanhar indicadores de confiabilidade como SLI, SLO e SLA; • Atuar na gestão e resposta a incidentes críticos; • Realizar troubleshooting avançado em ambientes distribuídos; • Garantir práticas de segurança relacionadas a IAM, TLS, gerenciamento de segredos e acesso; • Gerenciar plataformas de monitoramento e observabilidade como Prometheus, Grafana e Alertmanager; • Implementar estratégias para redução de falhas, eliminação de atividades repetitivas (toil) e aumento da automação; • Conduzir análises de causa raiz (RCA), postmortems e iniciativas de melhoria contínua; • Colaborar com times de desenvolvimento, arquitetura e operações para promover excelência operacional. . Habilidades e experiências Requisitos obrigatórios
• Experiência sólida atuando como DevOps Engineer, SRE ou posições similares; • Forte domínio de Git e GitHub (branching, pull requests e estratégias de versionamento); • Experiência avançada com Linux e Unix; • Conhecimento profundo em troubleshooting de aplicações e infraestrutura; • Experiência com Docker, incluindo build, otimização e segurança de imagens; • Experiência com Kubernetes para deploy, operação e diagnósticos; • Conhecimento em observabilidade (métricas, logs e tracing); • Experiência com Prometheus, Grafana e Alertmanager; • Vivência na definição e gestão de SLI, SLO e SLA; • Experiência com Infrastructure as Code utilizando Terraform, Pulumi ou similares; • Experiência em ambientes Cloud (Azure, AWS ou OCI); • Conhecimento em automação através de scripts; • Experiência com pipelines CI/CD; • Conhecimentos sólidos de redes e protocolos; • Experiência com segurança de infraestrutura, IAM, TLS e gestão de segredos; • Conhecimento em plataformas de logging como ELK Stack ou Loki; • Experiência com gestão de incidentes, confiabilidade e melhoria contínua; • Perfil analítico, colaborativo e orientado à resolução de problemas; Diferenciais
• Experiência com Service Mesh; • Conhecimento em arquiteturas resilientes e distribuídas; • Experiência com testes de performance e carga; • Vivência em ambientes multi-cloud; • Conhecimento em FinOps e otimização de custos em cloud; • Experiência com Apache Kafka; • Conhecimento em estratégias avançadas de deploy; • Experiência como referência técnica ou liderança técnica de times; • Certificações em Cloud, Kubernetes ou DevOps. .