Empresa: Sinqia
Oferecemos um portfólio completo de soluções em software, adquirência, processamento e tecnologias para meios de pagamento, contribuindo para a digitalização de instituições financeiras, empresas e fintechs. Nosso compromisso é com a excelência tecnológica, a inclusão financeira e a geração de valor sustentável para clientes, colaboradores e parceiros. Requisitos: Objetivo da Função Garantir alta disponibilidade, resiliência, performance e sustentação de sistemas críticos, atuando de forma estratégica na implementação de práticas de SRE, automação, CI/CD e governança operacional. Buscamos um profissional com perfil híbrido, combinando sólida experiência em Site Reliability Engineering (SRE) com forte atuação em Application Support, capaz de liderar iniciativas de confiabilidade, atuar diretamente na sustentação de aplicações críticas e conduzir análises complexas de incidentes em ambientes de missão crítica. Principais Responsabilidades Definir, implementar e evoluir práticas de SRE (SLI, SLO, SLA e Error Budget). Atuar como referência técnica na sustentação e suporte de aplicações críticas em produção. Realizar troubleshooting avançado de aplicações, integrações, APIs, bancos de dados, middleware e infraestrutura. Liderar e coordenar ações de resolução de incidentes críticos (P1/P2), minimizando impactos ao negócio. Conduzir análises de causa raiz (RCA/Post-Mortem) e implementar melhorias estruturais para prevenção de recorrências. Projetar e otimizar pipelines CI/CD com foco em segurança, rastreabilidade e eficiência operacional. Liderar iniciativas de automação de infraestrutura e processos operacionais. Gerenciar e aprimorar ambientes críticos com alta exigência de disponibilidade (trading, pagamentos, liquidação, sistemas financeiros e transacionais). Implementar e evoluir estratégias de observabilidade (monitoramento, logging, tracing e alertas). Trabalhar em conjunto com times de desenvolvimento, infraestrutura, arquitetura e negócio para garantir estabilidade e performance das aplicações. Garantir aderência a requisitos regulatórios, compliance e auditoria (SOX, PCI-DSS e similares). Colaborar com equipes globais utilizando inglês no dia a dia. Requisitos Técnicos Obrigatórios SRE e Application Support Experiência sólida em ambientes de Produção, SRE, Operações ou Application Support. Forte experiência em sustentação e suporte de aplicações críticas. Histórico comprovado de atuação em análise e resolução de incidentes complexos em ambiente produtivo. Experiência com gerenciamento de problemas, identificação de causa raiz e implementação de ações preventivas. Conhecimento de monitoramento e observabilidade aplicados à operação de sistemas críticos. Vivência com atendimento de incidentes, gestão de crises e war rooms. CI/CD e Automação Forte experiência com CI/CD: GitHub Actions Jenkins GitLab CI ou equivalentes Design de pipelines complexos e escaláveis. Automação de processos operacionais e infraestrutura. Git e Versionamento Domínio de Git e GitHub: Estratégias de branching Code Review avançado Automação com workflows Infraestrutura Conhecimento avançado em Linux. Experiência sólida com infraestrutura híbrida:AWS, Azure ou GCP Ambientes On-Premise Forte conhecimento em redes: Latência Balanceamento Troubleshooting Segurança Containers e IaC Docker e Kubernetes. Terraform, Ansible ou ferramentas equivalentes. Aplicações e Dados Conhecimento em arquitetura de aplicações corporativas. Experiência com APIs, microsserviços e integrações. Bons conhecimentos de bancos de dados relacionais e SQL para troubleshooting e investigação de incidentes. Diferenciais Altamente Relevantes Experiência em ambientes financeiros de alta criticidade e baixa latência. Conhecimento em: Kafka RabbitMQ Experiência com sistemas transacionais e processamento em tempo real. Práticas avançadas de resiliência e tolerância a falhas. Conhecimento em segurança da informação, criptografia e controle de acesso. Vivência com suporte a aplicações de missão crítica voltadas ao mercado financeiro. Observabilidade e Operação Experiência com ferramentas como: Prometheus Grafana ELK Stack / OpenSearch Datadog New Relic Dynatrace (desejável) Responsável por: Criação de métricas, alertas e dashboards estratégicos. Definição e acompanhamento de indicadores de confiabilidade. Monitoramento proativo da saúde das aplicações e infraestrutura. Inglês Avançado (Mandatório) Participação ativa em reuniões com equipes globais. Comunicação durante incidentes críticos e war rooms. Produção e atualização de documentação técnica. Interação com times internacionais de tecnologia e negócios. Necessário disponibilidade para escala de quarta-feira a domingo: 15:30 à 00:00. Vaga híbrida, com necessidade do presencial 1x por semana na Faria Lima. Sobre a empresa: Somos a única solução completa para o mercado financeiro! A Evertec é uma empresa especializada em tecnologia para o setor financeiro, com mais de 27 anos de atuação no mercado, e presença em 26 países da América Latina e Caribe e mais de 11 bilhões de transações processadas anualmente.