**DEVOPS/SRE II** **Resumo:** Atuar como responsável por garantir a confiabilidade, disponibilidade, desempenho e escalabilidade dos ambientes e aplicações da organização e terá papel fundamental na evolução das práticas de confiabilidade, automação operacional e observabilidade, trabalhando em parceria com equipes de desenvolvimento, infraestrutura, segurança e operações para promover uma cultura orientada à estabilidade e melhoria contínua. **Responsabilidades:** Garantir a disponibilidade, estabilidade e performance dos ambientes produtivos. Atuar na investigação, mitigação e resolução de incidentes em ambientes críticos. Participar de war rooms, apoiando a análise técnica e a restauração dos serviços. Implementar e manter soluções de observabilidade, monitoramento, logs, métricas e alertas. Desenvolver e manter automações operacionais para reduzir atividades manuais e recorrentes. Executar rotinas de sustentação, deploy, troubleshooting e validação de ambientes. Apoiar iniciativas de segurança operacional, correção de vulnerabilidades e aplicação de boas práticas. Acompanhar pipelines, integrações e processos de CI/CD, atuando na resolução de falhas. Participar de análises de causa raiz (RCA) e apoiar a elaboração de planos de ação. Conduzir revisões pós\-incidente com foco em aprendizado contínuo e melhoria dos processos. Definir, acompanhar e reportar indicadores de confiabilidade, disponibilidade, incidentes e performance. Realizar capacity planning e identificar gargalos de infraestrutura, aplicações e serviços. Propor melhorias em automações, monitoramento, pipelines e processos operacionais. Apoiar a evolução de práticas de SRE alinhadas às necessidades das áreas técnicas e de negócio. Acompanhar a evolução das demandas analíticas, priorizando entregas conforme impacto para o negócio. Participar da definição de estratégias de alta disponibilidade, recuperação de desastres e continuidade de serviços. Contribuir para a evolução das práticas de SRE e DevOps, alinhando confiabilidade, eficiência operacional e objetivos do negócio. Apoiar decisões técnicas relacionadas à arquitetura operacional, resiliência e escalabilidade dos ambientes. Identificar oportunidades de melhoria estrutural para aumentar maturidade, confiabilidade e eficiência dos serviços. **Requisitos da vaga:** Ensino super completo em Ciência da Computação; Engenharia da Computação; Sistemas de Informação; Redes de computadores; Segurança da Informação. Conceitos de redes: (TCP/IP, DNS, HTTP/HTTPS, Balanceamento de carga, Firewalls, VPN, Certificados SSL/TLS); Cloud Computing (AWS preferencialmente) Containers e Orquestração; Ferramentas de observabilidade e monitoramento (Prometheus, Grafana, Datadog, New Relic, Zabbix) Automação (Python, bash, powershell); Conhecimentos de Banco de Dados SQL e Postgress (diferencial). **Benefícios:** 🍴 Vale Refeição ou Alimentação. 🏬 Cartão multibenefícios. 🦷 Assistência Odontológica. 🏥 Convênio médico. ❤ Seguro de Vida. 🚌 Vale Transporte. 🎓 Parcerias com faculdades. 🎭 Parceria com o SESC. 🎈 Day Off no mês do aniversário. 💪 Wellhub.