Analista de Infraestrutura Sênior (Cloud AWS & Observabilidade)
Grupo H2 · São Paulo, SP, BR
Buscamos uma pessoa analista de Infraestrutura Sênior foco em Cloud AWS \& Observabilidade para assumir um papel de referência técnica na sustentação, evolução e modernização da nossa base tecnológica, assegurando máxima disponibilidade, performance, segurança e escalabilidade dos ambientes corporativos e digitais. A posição possui forte direcionamento para Cloud AWS e traz como pilar essencial uma responsabilidade protagonista em Observabilidade, Gestão de Incidentes críticos, Gestão de Mudanças estruturada e condução técnica de Salas de Crise (War Rooms). Trata\-se de uma oportunidade sênior de alto impacto em uma infraestrutura crítica e híbrida que sustenta produtos digitais em constante evolução. **Principais responsabilidades:** * **Foco em Cloud AWS e Ambientes Híbridos:** Liderar e apoiar a implementação, provisionamento, sustentação e otimização contínua de arquiteturas e serviços em nuvem com foco primordial em AWS (podendo atuar também com Azure ou GCP), assegurando conectividade, segurança, eficiência de custos e alta performance; administrar, sustentar e evoluir a infraestrutura on\-premises, servidores (Linux e Windows), virtualização e serviços críticos; * **Observabilidade de Ponta a Ponta:** Estruturar, aprimorar e liderar iniciativas de observabilidade, telemetria, logging centralizado, dashboards, métricas e alertas inteligentes (CloudWatch e ferramentas de mercado), promovendo visibilidade em tempo real e monitoramento proativo de integridade dos serviços; * **Gestão de Incidentes Críticos e Salas de Crise (War Rooms):** Atuar como referência técnica na condução, triagem e facilitação de Salas de Crise, liderando equipes multidisciplinares na contenção e resolução rápida de incidentes graves de alta complexidade; coordenar a elaboração estruturada de Análise de Causa Raiz (RCA / Post\-Mortem) e planos de ação para mitigar recorrências; * **Gestão de Mudanças (Change Management):** Avaliar, planejar, validar e acompanhar mudanças em ambientes críticos e de produção, garantindo análise rigorosa de riscos, planos de rollback e alinhamento às boas práticas de governança técnica para assegurar a continuidade do negócio; * **Engenharia de Redes e Conectividade:** Administrar e otimizar ambientes de conectividade corporativa e cloud (LAN, WAN, WLAN, VPN, SD\-WAN, firewalls, switches, roteadores, balanceadores de carga e proxies), assegurando conexões seguras, estáveis e performáticas entre datacenters, nuvem e usuários finais; * **Automação e Infraestrutura como Código (IaC):** Conduzir e incentivar o uso de automações e IaC via Terraform, Ansible, CloudFormation, PowerShell ou Python, visando eliminar tarefas manuais, mitigar erros humanos e acelerar entregas padronizadas; * **Segurança da Informação e Hardening:** Atuar em estreita colaboração com o time de Segurança da Informação na aplicação de boas práticas em nuvem (AWS), redes e infraestrutura (IAM, segmentação, criptografia, controles de acesso e mitigação de vulnerabilidades); * **Modernização Tecnológica e Governança:** Conduzir frentes técnicas em projetos de migração para cloud e transformação digital; manter documentações arquiteturais, processos operacionais e inventários rigorosamente atualizados. Requisitos: **Requisitos obrigatórios:** * Sólida vivência e domínio sênior em ambientes Cloud AWS, com conhecimento aprofundado em serviços centrais como EC2, S3, RDS, IAM, VPC, CloudWatch, Lambda, EKS/ECS ou equivalentes, além de arquitetura resiliente e melhores práticas de segurança e conectividade na nuvem; * Domínio prático e experiência comprovada em Observabilidade, monitoramento e telemetria (métricas, logs, traces, dashboards e criação de alertas inteligentes); * Experiência sênior na gestão e resposta a incidentes complexos, troubleshooting estruturado e condução técnica de Salas de Crise / War Rooms em ambientes de missão crítica e alta disponibilidade; * Vivência sólida em processos de Gestão de Mudanças, avaliação de impactos, mitigação de riscos e procedimentos de contingência/rollback; * Ampla experiência em sustentação e administração de infraestrutura corporativa, incluindo servidores, virtualização e sistemas operacionais Linux e Windows, com atuação consolidada em ambientes híbridos (on\-premises \+ cloud); * Domínio de fundamentos de redes corporativas, roteamento, switching, VPNs, firewalls, balanceadores de carga e conectividade crítica; * Conhecimento prático em automação e Infraestrutura como Código (IaC) utilizando ferramentas como Terraform, Ansible, CloudFormation, scripts em Python, PowerShell ou similares; * Noções consistentes de segurança em infraestrutura, redes e cloud: IAM, controle de acessos, segmentação de redes, criptografia, hardening e proteção de ambientes críticos. **Diferenciais e Formação:** * Experiência adicional em Azure ou GCP; * Desejável formação superior completa em Engenharia da Computação, Redes de Computadores, Sistemas de Informação, Ciência da Computação ou áreas correlatas (profi