Engenheiro de Confiabilidade de Site (SRE)

Indeed

Empresa

Tipo de empregoTempo Integral
Modalidade de TrabalhoPresencial
Nível de ExperiênciaSem Limite de Experiência
Nível de EducaçãoSem Limite de Formação

Descrição

Resumo: A Paymentology procura um excepcional Engenheiro de Confiabilidade de Site (SRE) para manter, melhorar e garantir alta disponibilidade, escalabilidade e desempenho de sua plataforma global. Pontos principais: 1. Desenvolver software que aprimore a escalabilidade e confiabilidade dos serviços 2. Contribuir para soluções de observabilidade e automação 3. Colaborar entre equipes para impulsionar soluções inovadoras A Paymentology é o primeiro emissor-processador verdadeiramente global, oferecendo aos bancos e fintechs a tecnologia, a equipe e a experiência necessárias para emitir e processar rapidamente cartões Mastercard, Visa e UnionPay em mais de 60 países, em escala. Nossa avançada plataforma multi-nuvem, que oferece instâncias de processamento compartilhadas e dedicadas, uma vasta presença global e dados em tempo real mais ricos, nos diferencia como líder no setor de pagamentos. Estamos à procura de um excepcional **Engenheiro de Confiabilidade de Site (SRE)** para integrar nossa equipe dedicada. Como SRE na Paymentology, você será o herói responsável por manter, melhorar e garantir a alta disponibilidade, escalabilidade e desempenho de nossa plataforma. Requisitos: **O que é necessário para ter sucesso:** * Graduação em Ciência da Computação, Tecnologia da Informação ou área correlata. * Mínimo de 3 anos em cargo exclusivo de SRE, além de 5+ anos de experiência prévia em desenvolvimento de software. * Compreensão abrangente de arquitetura de plataformas distribuídas em larga escala. * Amplo conhecimento prático em nuvem, especialmente com AWS. * Experiência comprovada no desenvolvimento de projetos escaláveis e modulares de infraestrutura como código (IaC), utilizando ferramentas como Terraform, CloudFormation, Puppet e Ansible. * Experiência prática com Docker e orquestradores de contêineres, incluindo AWS ECS & EKS e Kubernetes. * Experiência na administração ou integração de sistemas de gerenciamento de identidade para SSO, incluindo AWS IAM, Okta e Active Directory. * Experiência com estratégias de recuperação de desastres e redundância, tanto em ambientes de nuvem quanto locais (on-premises). * Domínio de ferramentas líderes de monitoramento, tais como Datadog, Honeycomb.io, Splunk, Prometheus, Grafana, ELK Stack e New Relic. * Expertise em programação, especialmente em linguagens de programação de sistemas (ex.: Java, Kotlin, Scala) e bancos de dados (ex.: SQL Server, PostgreSQL). * Familiaridade com ferramentas líderes de CI/CD, tais como Jenkins, GitHub Actions, GitLab CI, CodePipelines, CircleCI e ArgoCD. * Histórico comprovado de definição e cumprimento de indicadores de nível de serviço (SLIs), objetivos de nível de serviço (SLOs) e acordos de nível de serviço (SLAs) em nível de plataforma e ponta a ponta, bem como fomento da responsabilização. * Capacidade de lidar com situações complexas e liderar revisões pós-incidente (PIRs) eficazes. * Conhecimento sobre implementação de soluções para reduzir o Tempo Médio para Identificação (MTTI) e o Tempo Médio para Resolução (MTTR). * Expertise na aplicação de melhores práticas para balanceamento de carga, tolerância a falhas e alocação de recursos, visando manter a qualidade e eficiência do serviço em escala. * Compreensão das melhores práticas de segurança em ambientes de nuvem. ****Você também precisará trazer uma mentalidade colaborativa, trabalhando perfeitamente entre equipes para impulsionar soluções inovadoras. E, naturalmente, suas excepcionais habilidades de comunicação em inglês permitirão que você transmita claramente suas ideias e recomendações. Como membro-chave de nossa equipe técnica, espera-se que você mantenha alta disponibilidade e esteja pronto para lidar com incidentes críticos, assegurando o desempenho contínuo de nossos sistemas. Isso inclui participar de um regime de plantão para suporte 24/7. **Por que escolher a Paymentology?** * Cargo remoto em tempo integral com horários flexíveis. * Um ambiente de trabalho inclusivo e solidário que valoriza a diversidade. * A oportunidade de trabalhar em projetos de tecnologia de ponta que fazem a diferença. * Oportunidades de aprendizado e desenvolvimento contínuos. **Pronto para se juntar a nós?** Se você é um entusiasta de tecnologia que se destaca ao otimizar infraestrutura, automatizar tudo e entregar alta disponibilidade e desempenho, queremos ouvir de você! Candidate-se agora e faça parte de uma empresa que valoriza suas habilidades e estimula seu crescimento. Suas responsabilidades:: **Confiabilidade e Escalabilidade da Plataforma:** * Desenvolver software que aprimore a escalabilidade e confiabilidade dos serviços da Paymentology. * Garantir que os serviços da plataforma atendam aos níveis exigidos de tempo de atividade e qualidade de serviço. * Contribuir para o projeto de infraestrutura em nuvem confiável e implementar componentes reutilizáveis de tempo de atividade em nuvem como código. * Revisar e otimizar regularmente as práticas, ferramentas e metodologias de SRE para aprimorar a confiabilidade geral do sistema e a eficiência da equipe. **Observabilidade e Automação:** * Contribuir para o projeto, implementação e manutenção de soluções de observabilidade e monitoramento destinadas a acompanhar a saúde da plataforma, sua eficiência de custos, sua confiabilidade e escalabilidade, além de identificar possíveis problemas que possam ser retroalimentados às equipes de engenharia de produto e plataforma em um ciclo contínuo de melhoria. * Desenvolver e implementar scripts e ferramentas de automação para simplificar operações e reduzir intervenções manuais. * Permitir que as equipes de produto façam autoatendimento, participando do desenvolvimento de uma plataforma para desenvolvedores. **Resolução de Problemas em Produção:** * Participar ativamente das equipes de resposta a incidentes, diagnosticando e resolvendo rapidamente problemas em produção para minimizar o tempo de inatividade. **Conformidade com Padrões:** * Apoiar as equipes de produto no desenvolvimento de serviços que estejam em conformidade com nossos padrões de segurança e qualidade. **Colaboração entre Equipes:** * Trabalhar em estreita colaboração com equipes de engenharia, operações e produto para garantir que a confiabilidade seja considerada durante todo o ciclo de vida de desenvolvimento de software. Buscamos alcançar isso por meio de advocacia e do desenvolvimento de uma cultura de confiabilidade. O que você poderá esperar:: Na Paymentology valorizamos fazer a diferença nas vidas das pessoas que trabalham para nós e das comunidades onde atuamos. Você poderá esperar trabalhar com uma equipe diversa e global, na qual os Paymentologists de todos os níveis desempenham um papel importante em nossa missão global de impulsionar o mundo por meio dos pagamentos e causar impacto em escala global. Viagens: \< 5%

Alguns conteúdos foram traduzidos automaticamente pelo sistema

Publicado por

João Santos

Indeed · HR

Localização

Vagas semelhantes

João Santos

Indeed · HR

Vagas semelhantes

Engenheiro de Confiabilidade de Site (SRE) da Indeed em 2026 | ok.com