Empresa: EY
Requisitos: • e habilidades que buscamos • Inglês avançado/fluente. • Bacharelado em Ciência da Computação, Engenharia ou áreas correlatas. • Sólida experiência em: • Site Reliability Engineering (SRE) • DevOps • Infraestrutura • Cloud Engineering • Experiência prática com: • AWS, Azure ou GCP • Terraform (preferencial) • Docker • Kubernetes • CI/CD • Python ou Bash • Linux/Unix • Monitoramento e observabilidade • Gestão de incidentes • Será considerado um diferencial: • Experiência em ambientes de grande escala. • Vivência em consultorias. • Experiência com Chaos Engineering. • Experiência com arquiteturas altamente distribuídas. • Forte background em observabilidade. • Conhecimento avançado em Kafka. • Experiência em plataformas financeiras ou ambientes críticos. • Conheça alguns de nossos benefícios: Assistência médica e odontológica, Auxílio creche, Plataforma de benefícios e descontos exclusivos EY, Incentivos à educação, Day off de aniversário, Gympass/Wellhub, Participação nos Lucros (PLR), Previdência privada, Vale Alimentação e / ou Vale Alimentação e Transporte, e muito mais. O que oferecemos: • Na EY, você se desenvolve com habilidades voltadas para o futuro e se abastece de experiências de classe mundial. Nós capacitaremos você em um ambiente flexível e potencializaremos seus talentos extraordinários em uma cultura diversa e inclusiva, com equipes globalmente conectadas. • Pelo 4º ano consecutivo, a EY está na lista do Great Place to Work como uma das melhores empresa para se trabalhar, com destaque para as categorias de diversidade. Você poderá fazer parte de nossos programas e grupos que, juntos a inúmeras iniciativas internas, apoiam nossa constante busca pela equidade. • Você gostaria de moldar seu futuro com confiança? Inscreva-se hoje! • Para ajudar a criar a melhor experiência durante o processo de recrutamento, por favor, descreva qualquer acessibilidade você possa precisar. • Saiba mais sobre como é trabalhar na EY: • Carreiras na EY LinkedIn @EY Instagram @eybrasilcarreiras • #ServiceDesk #ServiceNow #ITSM #EUC #FSOEY #TechEY #CarreirasEY #Inclusão #Diversidade #TI #GestãoDeServiços #SãoPaulo #Manager #OportunidadeEY #TechFSO Sobre a empresa: Site Reliability Engineer (SRE) Na EY, estamos comprometidos em moldar seu futuro com confiança. Nós ajudaremos você a ter sucesso em um ambiente globalmente conectado, repleto de equipes diversas, e a levar sua carreira para onde você desejar. Venha para EY e ajude-nos a construir um mundo de negócios melhor. Sobre a oportunidade Estamos buscando uma Pessoa Site Reliability Engineer (SRE) para liderar iniciativas de confiabilidade, automação e escalabilidade de ambientes cloud, garantindo alta disponibilidade, performance e resiliência dos sistemas dos clientes. A posição está inserida na prática de Technology Consulting da FSO, atuando em projetos estratégicos e ambientes de missão crítica. Você assumirá as seguintes responsabilidades Como Pessoa SRE, você será responsável por garantir a confiabilidade e eficiência operacional dos ambientes através de automação, observabilidade e boas práticas de engenharia. Automação e Eficiência Operacional • Automatizar processos operacionais, deploys e provisionamento. • Desenvolver scripts e ferramentas internas (Python, Bash, etc.). • Implementar e evoluir pipelines CI/CD. • Reduzir atividades manuais e operacionais repetitivas. Infraestrutura Cloud e IaC • Provisionar e manter ambientes em nuvem. • Trabalhar com Infrastructure as Code (Terraform, CloudFormation). • Garantir escalabilidade e alta disponibilidade. • Implementar estratégias de auto-scaling e self-healing. Confiabilidade e Performance • Monitorar sistemas através de métricas, logs e traces. • Definir e acompanhar SLIs, SLOs e SLAs. • Executar capacity planning. • Realizar troubleshooting e otimização de performance. Gestão de Incidentes • Atuar em incidentes críticos de produção. • Conduzir análises de causa raiz (RCA). • Desenvolver planos de melhoria contínua. Observabilidade • Implementar ferramentas de monitoramento e alertas. • Criar dashboards operacionais. • Aumentar a visibilidade end-to-end dos sistemas. Engenharia de Plataforma • Trabalhar em conjunto com times de desenvolvimento. • Apoiar práticas DevOps e SRE. • Melhorar arquitetura, deploys e resiliência das aplicações. Continuidade de Negócios • Disaster Recovery. • Testes de carga e stress. • Chaos Engineering. • Estratégias de resiliência operacional. Governança e Boas Práticas • Definir padrões operacionais. • Documentar processos e arquiteturas. • Aplicar práticas de segurança e DevSecOps.