ENGENHEIRO DE CONFIABILIDADE DE SITES (SRE) (HÍBRIDO / REMOTO)

Empresa
Descrição
Resumo: Procuramos um Engenheiro de Confiabilidade de Sites (SRE) experiente para aprimorar ambientes em nuvem empresariais por meio de automação, observabilidade e excelência operacional, garantindo alta disponibilidade e resiliência. Pontos de Destaque: 1. Construir Plataformas em Nuvem Altamente Confiáveis em Escala Empresarial 2. Cultura Moderna de Engenharia de Confiabilidade de Sites (SRE) 3. Papel de alto impacto apoiando plataformas críticas para a missão #### **ENGENHEIRO DE CONFIABILIDADE DE SITES (SRE) (HÍBRIDO / REMOTO NO BRASIL)** Empresa portuguesa contrata para posição híbrida Localização: Brasil (qualquer localidade) * ️ Apenas candidatos já residentes no Brasil serão considerados Modelo de Trabalho: Híbrido para candidatos que residem nas capitais estaduais e Remoto para candidatos que residem no interior/cidades fora das capitais estaduais ️ Requisitos de Idioma: Inglês avançado/fluido – **Obrigatório** (haverá contato direto com cliente internacional) Nível de Experiência: Sênior (6\+ anos) Remuneração: Informe suas expectativas salariais ao se candidatar. * ️ Instruções: Envie seu currículo em inglês e certifique-se de incluir todas as habilidades e experiências que correspondam aos requisitos da oportunidade. Isso aumentará significativamente suas chances de sucesso. #### **Construir Plataformas em Nuvem Altamente Confiáveis em Escala Empresarial** Estamos procurando um Engenheiro de Confiabilidade de Sites (SRE) experiente para melhorar a confiabilidade, escalabilidade, desempenho e excelência operacional dos ambientes em nuvem empresariais. Você trabalhará em estreita colaboração com equipes de desenvolvimento, plataformas e infraestrutura para automatizar operações, melhorar a observabilidade, otimizar implantações e garantir alta disponibilidade em sistemas críticos para a missão. Se você gosta de resolver desafios complexos de infraestrutura por meio de engenharia, automação e tecnologias modernas em nuvem, esta é a oportunidade ideal para você. #### **O Profissional que Estamos Procurando** Buscamos um Engenheiro de Confiabilidade de Sites (SRE) altamente qualificado, com vasta experiência em infraestrutura em nuvem, práticas DevOps, automação e sistemas distribuídos. O candidato ideal combina sólidos conhecimentos em infraestrutura com princípios de engenharia de software, ajudando organizações a melhorar a eficiência operacional por meio de automação, Infraestrutura como Código (IaC), observabilidade e melhoria contínua. Você deve estar confortável trabalhando em ambientes de alta disponibilidade, respondendo a incidentes críticos e aprimorando continuamente a resiliência da plataforma. #### **Principais Responsabilidades** Você será responsável por: **Automação \& Excelência Operacional** * Automatizar processos operacionais, implantações e provisionamento de infraestrutura. * Desenvolver ferramentas internas de automação usando **Python** e **Bash**. * Projetar, implementar e otimizar pipelines CI/CD. * Reduzir atividades operacionais repetitivas por meio da automação. **Infraestrutura em Nuvem \& Infraestrutura como Código** * Provisionar e gerenciar infraestrutura em nuvem. * Implementar Infraestrutura como Código usando **Terraform** (preferencialmente) e outras ferramentas IaC. * Garantir escalabilidade, resiliência e alta disponibilidade. * Projetar soluções de autoescalabilidade e autorrecuperação. **Confiabilidade \& Desempenho** * Monitorar aplicações e infraestrutura usando métricas, logs e rastreamento distribuído. * Definir e monitorar **SLIs, SLOs e SLAs**. * Realizar planejamento de capacidade. * Solucionar gargalos de desempenho e problemas do sistema. **Gestão de Incidentes** * Responder a incidentes críticos em produção. * Realizar Análise de Causa Raiz (RCA). * Impulsionar iniciativas de melhoria contínua. **Observabilidade** * Implementar plataformas de monitoramento, alertas e observabilidade. * Criar dashboards operacionais. * Melhorar a visibilidade de ponta a ponta do sistema. **Engenharia de Plataforma** * Colaborar estreitamente com equipes de engenharia de software. * Apoiar as melhores práticas DevOps e SRE. * Aprimorar processos de implantação, arquitetura de sistemas e resiliência de aplicações. **Continuidade dos Negócios** * Apoiar estratégias de Recuperação de Desastres. * Executar testes de carga e estresse. * Implementar práticas de Engenharia do Caos. * Aprimorar a resiliência operacional. **Governança** * Definir padrões operacionais. * Documentar infraestrutura e arquitetura. * Promover boas práticas de segurança e princípios DevSecOps. #### **Requisitos Obrigatórios (Eliminatórios)** * ️ **Todos os requisitos abaixo são obrigatórios e eliminatórios.** Candidatos que não conseguirem demonstrar claramente essas qualificações em seu currículo dificilmente prosseguirão no processo seletivo. **Educação** ✔ Graduação em: * Ciência da Computação * Engenharia * ou área correlata #### **Experiência Obrigatória** * Inglês avançado/fluido. * Experiência comprovada como **Engenheiro de Confiabilidade de Sites (SRE)**. * Sólida experiência em: * Engenharia de Confiabilidade de Sites (SRE) * DevOps * Infraestrutura em Nuvem * Engenharia em Nuvem * Experiência prática com pelo menos uma grande plataforma em nuvem: * AWS * Microsoft Azure * Google Cloud Platform (GCP) * Experiência prática com: * Terraform (preferencial) * Docker * Kubernetes * Pipelines CI/CD * Python ou Bash * Linux/Unix * Sólida experiência com plataformas de monitoramento e observabilidade. * Gestão de Incidentes e Suporte em Produção. * Fortes habilidades de solução de problemas e troubleshooting. * Experiência na construção de sistemas altamente disponíveis e escaláveis. #### **Habilidades Desejáveis** As seguintes qualificações serão consideradas uma grande vantagem: * Ambientes empresariais em larga escala. * Experiência em consultoria. * Engenharia do Caos. * Arquiteturas altamente distribuídas. * Plataformas avançadas de observabilidade. * Apache Kafka. * Serviços Financeiros ou ambientes críticos para a missão. * DevSecOps. * Engenharia de Plataforma. #### **O Que Você Encontrará nesta Oportunidade** * Projetos de infraestrutura em nuvem em escala empresarial. * Cultura moderna de Engenharia de Confiabilidade de Sites (SRE). * Iniciativas nativas em nuvem e de Engenharia de Plataforma. * Práticas sólidas de DevOps e Infraestrutura como Código. * Colaboração com equipes internacionais de engenharia. * Papel de alto impacto apoiando plataformas críticas para a missão. * Ambiente de engenharia moderno focado em automação e excelência operacional. #### **Antes de se Candidatar, Faça a Si Mesmo Estas 5 Perguntas** ✅ Já atuei como **Engenheiro de Confiabilidade de Sites (SRE)** ou em cargo equivalente voltado para **confiabilidade em nuvem, automação e excelência operacional**? ✅ Meu currículo demonstra claramente experiência prática com **AWS, Azure ou GCP**, bem como com **Terraform, Docker, Kubernetes, Linux, Python/Bash e pipelines CI/CD**? ✅ Já implementei **soluções de observabilidade**, gerenciei incidentes em produção, realizei **Análise de Causa Raiz (RCA)** e trabalhei com **SLIs, SLOs e SLAs**? ✅ Tenho experiência projetando ambientes em nuvem altamente disponíveis, escaláveis e resilientes utilizando Infraestrutura como Código e melhores práticas DevOps? ✅ Sou fluente em inglês e me sinto à vontade colaborando com equipes internacionais de engenharia em ambientes produtivos críticos para a missão? Se você respondeu **"Não"** a uma ou mais dessas perguntas, recomendamos que revise cuidadosamente sua adequação antes de se candidatar. * **️ Importante** Esta vaga destina-se a um **Engenheiro de Confiabilidade de Sites (SRE) Sênior**, com vasta experiência em **infraestrutura em nuvem, automação, observabilidade, DevOps e confiabilidade de plataformas**. Candidatos cuja experiência concentra-se principalmente em administração tradicional de infraestrutura, suporte de sistemas ou operações, sem comprovação de especialização em **Infraestrutura como Código, Kubernetes, plataformas em nuvem, automação, CI/CD e práticas de Engenharia de Confiabilidade de Sites (SRE)**, provavelmente não atenderão às expectativas desta função. #### **Palavras-Chave que Devem Aparecer em Seu Currículo** **Engenheiro de Confiabilidade de Sites, SRE, Engenheiro DevOps, Engenheiro de Plataforma, Engenheiro em Nuvem, Engenheiro de Infraestrutura, Infraestrutura em Nuvem, AWS, Amazon Web Services, Microsoft Azure, Google Cloud Platform, GCP, Terraform, Infraestrutura como Código, IaC, Docker, Kubernetes, Linux, Unix, Python, Bash, Shell Scripting, CI/CD, Jenkins, GitLab CI, GitHub Actions, Monitoramento, Observabilidade, Prometheus, Grafana, ELK Stack, OpenTelemetry, Rastreamento Distribuído, Logging, Métricas, SLI, SLO, SLA, Gestão de Incidentes, Análise de Causa Raiz, RCA, Planejamento de Capacidade, Autoescalabilidade, Autorrecuperação, Recuperação de Desastres, Engenharia do Caos, DevSecOps, Engenharia de Plataforma, Apache Kafka, Alta Disponibilidade, Escalabilidade, Infraestrutura Empresarial, Serviços Financeiros** \#EP
Publicado por

João Santos
Indeed · HR




