Principais Responsabilidades e Atribuições:
Definir e evoluir a arquitetura de infraestrutura e plataforma para aplicações internas e de terceiros;
Projetar a estratégia completa de observabilidade e alertas, com foco em detecção proativa de degradações;
Estabelecer e governar o framework de SLIs, SLOs e error budgets, junto aos times de produto e engenharia;
Liderar tecnicamente a construção de pipelines de CI/CD robustos e escaláveis, incluindo estratégias de deploy progressivo (blue/green, canary);
Arquitetar soluções de disaster recovery multi-cloud (AWS/GCP) e híbridas (cloud/on-prem), conduzindo testes periódicos de DR;
Definir padrões de IaC, automação de configuração e governança de infraestrutura;
Conduzir post-mortems e garantir a implementação de ações corretivas sistêmicas;
Liderar iniciativas de chaos engineering para validar a resiliência dos serviços;
Atuar como interlocutor técnico entre times de desenvolvimento e operações nas decisões arquiteturais;
Garantir a confiabilidade de workloads containerizados serverless, bancos gerenciados e barramentos de eventos;
Orientar e desenvolver profissionais menos experientes do time;
Definir e acompanhar métricas de maturidade operacional e capacidade dos sistemas.
Graduação completa em Ciência da Computação, Engenharia, Tecnologia da Informação e/ou áreas afins;
Experiência avançada com serviços AWS (ECS/Fargate, Lambda, RDS, MSK, CloudWatch, IAM, VPC, Transit Gateway, Organizations);
Domínio de Infrastructure as Code (Terraform, CloudFormation ou similar) com práticas de modularização e reutilização;
Experiência consolidada com automação de configuração (Ansible, Chef ou similar);
Proficiência em ferramentas de CI/CD de mercado e definição de estratégias de release;
Conhecimento profundo de arquitetura de microserviços e event-driven com Kafka;
Experiência em projetar e operar stacks de observabilidade de ponta a ponta;
Domínio de práticas de SRE: definição de SLIs/SLOs, gestão de error budgets, post-mortems, redução de trabalho repetitivo e plano de capacidade;
Vivência com planejamento e execução de DR multi-cloud ou híbrido;
Experiência com chaos engineering e testes de resiliência em produção;
Capacidade analítica elevada, resolução de problemas complexos e comunicação clara com públicos técnicos e não técnicos.
Experiência prática com GCP em cenários de DR ou multi-cloud ativo;
Certificações AWS de nível Professional ou Specialty;
Experiência com construção de Internal Developer Platforms (IDP);
Conhecimento em service mesh e segurança zero-trust em ambientes distribuídos;
Vivência com FinOps e otimização de custos em escala;
Participação em programas de on-call estruturados com escalonamento e runbooks automatizados;
Contribuição ativa em comunidades ou publicações técnicas na área;
Vivência em ambientes de alta criticidade no mercado financeiro;
Inglês avançado (Diferencial)
Soft Skills:
Perfil colaborativo e orientado à resolução de problemas;
Perfil autônomo e proativo;
Raciocínio lógico.
Rehva Tech
DevOps/SRE Senior
#
Não Informado
Não Informado
Publicada há 4 horas
Confira outras oportunidades que podem combinar com esta vaga.
Entre na nossa base e tenha seu perfil exposto a milhares de recrutadores por todo o Brasil
Ver Outras Vagas Cadastrar meu PerfilDê um up nas suas habilidades profissionais.