Sobre esta vaga de Analista de Infraestrutura (DevOps/SRE) Sr. na Base Flowa
No seu dia a dia, você irá atuar com:
-
Definir e evoluir a arquitetura de infraestrutura e plataforma para aplicações internas e de terceiros;
-
Projetar a estratégia completa de observabilidade e alertas, com foco em detecção proativa de degradações;
-
Estabelecer e governar o framework de SLIs, SLOs e error budgets, junto aos times de produto e engenharia;
-
Liderar tecnicamente a construção de pipelines de CI/CD robustos e escaláveis, incluindo estratégias de deploy progressivo (blue/green, canary);
-
Arquitetar soluções de disaster recovery multi-cloud (AWS/GCP) e híbridas (cloud/on-prem), conduzindo testes periódicos de DR;
-
Definir padrões de IaC, automação de configuração e governança de infraestrutura;
-
Conduzir post-mortems e garantir a implementação de ações corretivas sistêmicas;
-
Liderar iniciativas de chaos engineering para validar a resiliência dos serviços;
-
Atuar como interlocutor técnico entre times de desenvolvimento e operações nas decisões arquiteturais;
-
Garantir a confiabilidade de workloads containerizados serverless, bancos gerenciados e barramentos de eventos;
-
Orientar e desenvolver profissionais menos experientes do time;
-
Definir e acompanhar métricas de maturidade operacional e capacidade dos sistemas.
O que você precisa:
-
Graduação completa em Ciência da Computação, Engenharia, Tecnologia da Informação e/ou áreas afins;
-
Experiência avançada com serviços AWS (ECS/Fargate, Lambda, RDS, MSK, CloudWatch, IAM, VPC, Transit Gateway, Organizations);
-
Domínio de Infrastructure as Code (Terraform, CloudFormation ou similar) com práticas de modularização e reutilização;
-
Experiência consolidada com automação de configuração (Ansible, Chef ou similar);
-
Proficiência em ferramentas de CI/CD de mercado e definição de estratégias de release;
-
Conhecimento profundo de arquitetura de microserviços e event-driven com Kafka;
-
Experiência em projetar e operar stacks de observabilidade de ponta a ponta;
-
Domínio de práticas de SRE: definição de SLIs/SLOs, gestão de error budgets, post-mortems, redução de trabalho repetitivo e plano de capacidade;
-
Vivência com planejamento e execução de DR multi-cloud ou híbrido;
-
Experiência com chaos engineering e testes de resiliência em produção;
-
Capacidade analítica elevada, resolução de problemas complexos e comunicação clara com públicos técnicos e não técnicos.
Serão considerados diferenciais:
-
Experiência prática com GCP em cenários de DR ou multi-cloud ativo;
-
Certificações AWS de nível Professional ou Specialty;
-
Experiência com construção de Internal Developer Platforms (IDP);
-
Conhecimento em service mesh e segurança zero-trust em ambientes distribuídos;
-
Vivência com FinOps e otimização de custos em escala;
-
Participação em programas de on-call estruturados com escalonamento e runbooks automatizados;
-
Contribuição ativa em comunidades ou publicações técnicas na área;