Engenheiro de Observabilidade – Engenheiro de Confiabilidade de Sites

Empresa
Descrição
Resumo: Procuramos um engenheiro de confiabilidade de sites (SRE) com especialização em engenharia de observabilidade para garantir a confiabilidade, visibilidade e desempenho das plataformas, com foco em automação e escalabilidade. Pontos de destaque: 1. Papel de alto impacto em uma empresa líder de comércio eletrônico 2. Oportunidade de trabalhar com tecnologias modernas de observabilidade 3. Influência nas decisões arquitetônicas e na estratégia da plataforma ### **Você procura um emprego que corresponda às suas ambições e ao seu estilo de vida?** ### **Continue lendo para descobrir o perfil que buscamos!** Desde seus primórdios como uma fábrica de lã, a La Redoute é uma marca francesa que, há 180 anos, construiu relações únicas com seus clientes — ontem por meio de catálogos, hoje pela web. Somos principalmente um jogador digital, vendendo moda e também decoração para o lar. **Sobre a função** Estamos procurando um engenheiro de confiabilidade de sites (SRE) com sólida experiência em engenharia de observabilidade para integrar nossa equipe na La Redoute. Esse papel é fundamental para garantir a confiabilidade, visibilidade e desempenho de nossas plataformas e serviços. O candidato ideal terá experiência prática com a pilha Grafana (Tempo, Loki, Mimir, Alloy), conhecimento em desenvolvimento Java, forte mentalidade SRE e paixão por automação, escalabilidade e senso de propriedade. Você fará parte de uma equipe motivada e multifuncional, responsável por implementar e escalar nossa nova pilha de observabilidade, que está sendo construída para ser uma plataforma de observabilidade para toda a empresa. Suas contribuições impactarão diretamente o desempenho dos sistemas, a experiência do usuário e a eficiência dos custos operacionais. **Responsabilidades** * Projetar, implementar e manter soluções de observabilidade abrangendo métricas, logs, rastreamentos e RUM. * Trabalhar com ferramentas como Grafana Cloud, Tempo, Loki, Mimir, Alloy, OpenTelemetry e Zabbix. * Construir pipelines confiáveis de alerta e monitoramento baseados em SLOs/SLAs, com foco em automação de baixa manutenção. * Garantir a saúde e integridade dos fluxos de dados de observabilidade, desde a instrumentação até os painéis. * Colaborar com equipes de desenvolvimento e operações para incorporar a observabilidade por design no ciclo de vida do software. * Definir e promover boas práticas e padrões de observabilidade em toda a organização. * Apoiar a modernização da observabilidade, substituindo e evoluindo soluções legadas de monitoramento e alerta. * Monitorar custos relacionados à observabilidade e contribuir para esforços de FinOps identificando oportunidades de otimização. **Requisitos** Obrigatórios: * 3 ou mais anos de experiência como SRE, engenheiro de observabilidade ou cargo equivalente. * Experiência prática com OpenTelemetry ou ferramentas semelhantes de instrumentação. * Conhecimento em Kubernetes, Helm, Terraform e ArgoCD. * Experiência no projeto e gerenciamento de pipelines de telemetria (métricas/logs/rastreamentos), exporters e sidecars. * Expertise em monitoramento de desempenho, alertas, criação de painéis e análise de causa-raiz. * Conhecimento em desenvolvimento Java e instrumentação de aplicações. * Mentalidade orientada a produtos, com viés para automação e cultura de “você constrói, você opera”. * Fluência em inglês. Desejáveis: * Conhecimento em soluções de APM e rastreamento distribuído. * Experiência com práticas de FinOps aplicadas à observabilidade. * Envolvimento prático na substituição de pilhas legadas de monitoramento. * Experiência em ambientes em nuvem (Azure preferencialmente). * Contribuições para ferramentas de observabilidade de código aberto. **O que oferecemos** * Papel de alto impacto em uma empresa líder de comércio eletrônico em plena transformação digital. * Equipe colaborativa e responsabilidade técnica. * Horários flexíveis e opções de trabalho remoto. * Oportunidade de trabalhar com tecnologias modernas de observabilidade. * Influência nas decisões arquitetônicas e na estratégia de longo prazo da plataforma.
Publicado por

João Santos
Indeed · HR