Especialista SRE | Platform Engineering
Raízen · São Paulo, São Paulo, Brazil
Somos uma empresa brasileira presente no seu dia a dia. Dos postos e produtos Shell, sempre no seu caminho, até a produção de açúcar, etanol e energia renovável. Aqui, segurança, integridade, colaboração e simplificação são a forma como a gente trabalha. Com mais de 30 mil pessoas, construímos juntos um ecossistema integrado que vai do campo, no cultivo da cana\-de\-açúcar, até a produção e comercialização de etanol, açúcar e bioenergia. Também atuamos, sob licença da marca Shell, na distribuição de combustíveis, lubrificantes e especialidades no Brasil. Se você é uma pessoa resiliente, que se move com velocidade, enfrenta desafios como oportunidades e acredita que colaboração é o caminho, a Raízen pode ser o seu lugar. Por aqui, o aprendizado vem da prática e o trabalho ganha mais sentido quando é feito junto. Todas as nossas vagas estão abertas a pessoas de qualquer orientação afetivo\-sexual, identidade de gênero, raça, etnia e idade, com ou sem deficiência. O que importa aqui é a vontade de crescer, contribuir e fazer a diferença. Estamos em busca de **Especialista SRE \| Plataform Engineering** para atuar na evolução das plataformas cloud, Kubernetes e automação corporativa. Essa posição terá papel estratégico na construção de soluções escaláveis, resilientes e modernas, apoiando diretamente a transformação tecnológica da companhia. O(A) profissional será responsável por atuar na evolução da plataforma Kubernetes, automações, observabilidade, GitOps e arquitetura de plataformas internas, apoiando times de desenvolvimento e infraestrutura na adoção de melhores práticas de engenharia, confiabilidade e operação. A posição atuará fortemente com ambientes Azure e AWS, Kubernetes (AKS/EKS), GitHub Actions, ArgoCD, observabilidade moderna e práticas de SRE, sempre buscando eficiência operacional, escalabilidade, segurança e melhoria contínua da plataforma. **Responsabilidades e atribuições** 🎯 **COMO SERÁ O SEU DIA A DIA:** * Evoluir e sustentar a plataforma Kubernetes corporativa (AKS/EKS), garantindo escalabilidade, segurança e alta disponibilidade dos ambientes; * Construir e aprimorar automações de infraestrutura e operações por meio de Infrastructure as Code e práticas GitOps; * Desenvolver e manter pipelines CI/CD, apoiando os times na jornada de entrega contínua; * Implementar soluções de observabilidade, monitoramento e tracing distribuído para garantir visibilidade e confiabilidade dos serviços; * Atuar na resolução de incidentes críticos, análise de causa raiz e implementação de melhorias contínuas na plataforma; * Apoiar times de desenvolvimento na adoção de boas práticas de cloud, Kubernetes, observabilidade e automação; * Evoluir a plataforma interna de engenharia, promovendo uma melhor experiência para desenvolvedores e acelerando a entrega de valor ao negócio; * Implementar e otimizar estratégias de autoscaling, gerenciamento de capacidade e eficiência operacional dos ambientes cloud; * Colaborar com times multidisciplinares na definição de padrões de arquitetura, segurança e governança para ambientes Azure e AWS; * Avaliar, testar e implementar novas soluções e tecnologias voltadas para Platform Engineering, SRE e automação corporativa. **Requisitos e qualificações** 🔎 **O QUE VOCÊ PRECISA TER:** **Requisitos Obrigatórios:** * Formação superior completa; * Experiência sólida na administração e evolução de ambientes Kubernetes, preferencialmente em plataformas gerenciadas como AKS (Azure Kubernetes Service) e/ou EKS (Amazon Elastic Kubernetes Service); * Vivência em ambientes de Cloud Pública, com atuação em Azure e/ou AWS, incluindo serviços de infraestrutura, redes e segurança; * Experiência na implementação e manutenção de pipelines CI/CD e práticas GitOps, utilizando ferramentas como GitHub Actions ou similares; * Conhecimento avançado em Infrastructure as Code (IaC), utilizando Terraform, Crossplane ou ferramentas equivalentes para provisionamento e governança de infraestrutura; * Experiência com soluções modernas de observabilidade, monitoramento, logging e tracing distribuído, utilizando ferramentas como Grafana, Prometheus, OpenTelemetry, Loki, Tempo ou similares; * Conhecimentos sólidos em Linux, containers e Docker, incluindo troubleshooting e otimização de ambientes containerizados; * Experiência com automação e desenvolvimento de scripts utilizando Bash, PowerShell, Python ou linguagens equivalentes; * Conhecimento de redes, DNS, Load Balancers, conectividade e segurança em ambientes cloud; * Capacidade de análise e resolução de problemas em ambientes distribuídos e de missão crítica; * Experiência na construção, sustentação e evolução de plataformas corporativas, com foco em confiabilidade, escalabilidade, automação e experiência dos times de desenvolvimento. **Requisitos Desejáveis:** * Experiência com ArgoCD e ecossistema GitOps; * Conhecimento em Argo Workflows e Argo Events para orquestração e automação de processos; * Experiência com Karpenter, Cluster Autoscaler ou outras s