Descrição
Resumo:
Procuramos um Engenheiro Sênior de Confiabilidade de Sites (SRE) para garantir a confiabilidade, escalabilidade e eficiência de plataformas críticas para a missão em uma infraestrutura global de mercados financeiros.
Pontos principais:
1. Apoiar plataformas críticas para a missão em mercados internacionais
2. Impacto significativo em sistemas distribuídos em larga escala
3. Impulsionar a melhoria contínua em iniciativas tecnológicas globais
Estamos procurando um **Engenheiro Sênior de Confiabilidade de Sites (SRE)** para integrar nossa equipe global de entrega, em regime totalmente remoto. Nesta posição, você apoiará um importante provedor global de infraestrutura de mercados financeiros, garantindo a confiabilidade, escalabilidade e eficiência das plataformas críticas para a missão utilizadas em mercados internacionais. Você trabalhará em estreita colaboração com equipes de desenvolvimento e operações para implementar as melhores práticas de SRE, automatizar operações e entregar sistemas seguros e altamente disponíveis. Trata-se de uma oportunidade para exercer um impacto significativo em sistemas distribuídos em larga escala e impulsionar a melhoria contínua em iniciativas tecnológicas globais.
**Responsabilidades**
* Colaborar com equipes de desenvolvimento, segurança, qualidade e operações para implementar os princípios de SRE
* Definir e gerenciar Objetivos de Nível de Serviço (SLOs), Indicadores de Nível de Serviço (SLIs) e orçamentos de erros
* Aplicar práticas para minimizar tarefas repetitivas, melhorar a resiliência e otimizar a capacidade
* Diagnosticar e resolver problemas de infraestrutura e aplicativos para manter a disponibilidade do sistema
* Projetar, implementar e manter sistemas robustos de monitoramento e alerta para aplicações e infraestrutura
* Contribuir para estratégias de automação e pipelines de CI/CD para acelerar implantações
* Garantir o cumprimento dos requisitos de segurança e conformidade em ambientes nativos de nuvem
**Requisitos**
* Graduação em Ciência da Computação, Engenharia ou experiência equivalente
* Experiência comprovada em SRE ou DevOps em ambientes de produção
* Expertise em qualquer plataforma de nuvem (AWS, GCP ou Azure)
* Bom entendimento das práticas de SRE, incluindo monitoramento, resposta a incidentes, orçamentos de erros e análises pós-incidente
* Domínio de Python ou outra linguagem de script/programação
* Conhecimento prático de pipelines de CI/CD, infraestrutura como código e ferramentas de gerenciamento de configuração
* Experiência com ferramentas de containerização e orquestração (Kubernetes, Docker)
* Sólida experiência com frameworks de monitoramento de desempenho de infraestrutura e aplicações
**Desejável**
* Experiência na implantação e gerenciamento de Modelos de Linguagem de Grande Porte (LLMs), incluindo soluções baseadas em RAG
* Certificações em nuvem e Kubernetes (AWS, GCP, Azure Certified, CKA/CKAD)
* Familiaridade com o gerenciamento do ciclo de vida de modelos de IA/ML em ambientes de produção
* Exposição à automação avançada e otimização de aplicações impulsionadas por IA
**Oferecemos**
* Remuneração competitiva, conforme experiência e habilidades
* Variedade de projetos dentro de uma única empresa
* Integração em um projeto que segue padrões de excelência em engenharia
* Trajetória profissional personalizada e oportunidades de crescimento
* Eventos internos e comunidades