DevOps/SRE Senior

Rehva Tech

📍 Rio de Janeiro/RJ· Tempo integral

Descrição da vaga

Principais Responsabilidades e Atribuições:No seu dia a dia, você irá atuar com:Definir e evoluir a arquitetura de infraestrutura e plataforma para aplicações internas e de terceiros;Projetar a estratégia completa de observabilidade e alertas, com foco em detecção proativa de degradações;Estabelecer e governar o framework de SLIs, SLOs e error budgets, junto aos times de produto e engenharia;Liderar tecnicamente a construção de pipelines de CI/CD robustos e escaláveis, incluindo estratégias de deploy progressivo (blue/green, canary);Arquitetar soluções de disaster recovery multi-cloud (AWS/GCP) e híbridas (cloud/on-prem), conduzindo testes periódicos de DR;Definir padrões de IaC, automação de configuração e governança de infraestrutura;Conduzir post-mortems e garantir a implementação de ações corretivas sistêmicas;Liderar iniciativas de chaos engineering para validar a resiliência dos serviços;Atuar como interlocutor técnico entre times de desenvolvimento e operações nas decisões arquiteturais;Garantir a confiabilidade de workloads containerizados serverless, bancos gerenciados e barramentos de eventos;Orientar e desenvolver profissionais menos experientes do time;Definir e acompanhar métricas de maturidade operacional e capacidade dos sistemas. O que você precisa:Graduação completa em Ciência da Computação, Engenharia, Tecnologia da Informação e/ou áreas afins;  Experiência avançada com serviços AWS (ECS/Fargate, Lambda, RDS, MSK, CloudWatch, IAM, VPC, Transit Gateway, Organizations);Domínio de Infrastructure as Code (Terraform, CloudFormation ou similar) com práticas de modularização e reutilização;Experiência consolidada com automação de configuração (Ansible, Chef ou similar);Proficiência em ferramentas de CI/CD de mercado e definição de estratégias de release;Conhecimento profundo de arquitetura de microserviços e event-driven com Kafka;Experiência em projetar e operar stacks de observabilidade de ponta a ponta;Domínio de práticas de SRE: definição de SLIs/SLOs, gestão de error budgets, post-mortems, redução de trabalho repetitivo e plano de capacidade;Vivência com planejamento e execução de DR multi-cloud ou híbrido;Experiência com chaos engineering e testes de resiliência em produção; Capacidade analítica elevada, resolução de problemas complexos e comunicação clara com públicos técnicos e não técnicos.Serão considerados diferenciais:Experiência prática com GCP em cenários de DR ou multi-cloud ativo;Certificações AWS de nível Professional ou Specialty;Experiência com construção de Internal Developer Platforms (IDP);Conhecimento em service mesh e segurança zero-trust em ambientes distribuídos;Vivência com FinOps e otimização de custos em escala;Participação em programas de on-call estruturados com escalonamento e runbooks automatizados;Contribuição ativa em comunidades ou publicações técnicas na área;Vivência em ambientes de alta criticidade no mercado financeiro;Inglês avançado (Diferencial)Soft Skills:Perfil colaborativo e orientado à resolução de problemas;Perfil autônomo e proativo;Raciocínio lógico.

Mais vagas em Rio de Janeiro

Todas as vagas em Rio de Janeiro/RJ →Vagas em Rio de Janeiro →