Descrição
Resumo:
Procuramos um SRE apaixonado e qualificado para aprimorar nossa plataforma de infraestrutura, impulsionando a transformação de um serviço legado para um modelo seguro e autoatendido, equilibrando integridade operacional e automação.
Pontos de destaque:
1. Impulsionar a transformação e inovação da infraestrutura em uma empresa orientada digitalmente.
2. Equilibrar a estabilidade operacional com automação proativa para eliminar dívidas técnicas.
3. Colaborar em soluções de ponta em nuvem e conteinerizadas.
### **Você quer um emprego que corresponda às suas ambições e ao seu estilo de vida?**
### **Leia mais para descobrir o perfil que buscamos!**
Desde seus primórdios como uma fábrica de lã, a La Redoute é uma marca francesa que, há 180 anos, construiu relações únicas com seus clientes — ontem por meio de catálogos, hoje pela web. Somos, principalmente, um jogador digital, vendendo moda bem como decoração para o lar.
Desde 2019, temos modernizado nossos sistemas legados e site, com foco na transição para soluções em nuvem e conteinerizadas. Essa transformação visa melhorar nossa escalabilidade, flexibilidade e desempenho geral, garantindo que permaneçamos na vanguarda dos avanços tecnológicos. Isso nos permite concentrar-nos em implantações flexíveis e encurtar o ciclo de vida do desenvolvimento de software, possibilitando entregar novos recursos à produção de forma mais rápida e eficiente.
Atualmente, a La Redoute busca um SRE apaixonado e qualificado para contribuir e aprimorar nossa plataforma de infraestrutura, desempenhando um papel fundamental em nossa jornada rumo à inovação e excelência.
**Sobre a posição**
Como membro da equipe de Plataforma de Infraestrutura da La Redoute, você ajudará a impulsionar nossa transformação de um serviço legado baseado em filas de chamados para um modelo de plataforma segura e autoatendida. Esta posição exige um equilíbrio entre manter a integridade operacional ("manter as luzes acesas") e impulsionar a automação proativa para eliminar dívidas técnicas, atritos entre equipes e pontos problemáticos.
Seu dia a dia combinará a manutenção da estabilidade de sistemas críticos em produção com a condução de melhorias significativas por meio da automação. Você será responsável pelo ciclo de vida de nossas máquinas virtuais em nuvem e locais, manterá, configurará e provisionará recursos computacionais, além de impor a postura de segurança implantando controles de endpoint (EDR) e gerenciando permissões de usuários, integrações de SSO e acesso à identidade em um ambiente multicloud. Você trabalhará lado a lado com a equipe de segurança para impor conformidade e reduzir os SLAs de correção de vulnerabilidades, transformando pontos problemáticos operacionais repetitivos em capacidades automatizadas da plataforma.
**Responsabilidades**
* Colaborar de perto com partes interessadas internas e externas, desenvolvedores e gestores para garantir entregas oportunas.
* Desenvolver, manter e dimensionar a gestão de configuração e o provisionamento automatizado usando Ansible em máquinas virtuais em nuvem e ambientes híbridos.
* Construir, proteger e operar infraestrutura escalável em plataformas de nuvem pública (predominantemente Azure), gerenciando instâncias de computação, redes e armazenamento.
* Colaborar estreitamente com a equipe de segurança para identificar vulnerabilidades, executar estratégias de mitigação, instalar componentes de segurança como EDR e garantir que os padrões de conformidade sejam atendidos em todos os sistemas gerenciados.
* Administrar e otimizar sistemas de gerenciamento de identidade, incluindo Azure Active Directory / EntraID, permissões de usuários e configurações de SSO, assegurando acesso seguro e contínuo.
* Escrever, revisar e refatorar módulos IaC usando Terraform dentro de um modelo estruturado de repositório Git.
* Automatizar provisionamento, configuração e recuperação operacional com mentalidade voltada prioritariamente à confiabilidade.
* Integrar pilhas robustas de monitoramento e registro para garantir alta disponibilidade, solucionar incidentes complexos de infraestrutura e participar de operações contínuas de confiabilidade de serviços.
* Manter consciência de custos e políticas de etiquetagem de recursos para apoiar a governança financeira da plataforma (FinOps).
* Participar da linha direta rotativa 24/7 para manter a resiliência do sistema.
**Requisitos**
* Experiência sólida como Engenheiro de Confiabilidade de Site, Engenheiro DevOps ou Engenheiro de Sistemas, gerenciando ambientes de produção na nuvem.
* Experiência operacional consistente com plataformas de nuvem pública, particularmente Microsoft Azure.
* Experiência com frameworks de gerenciamento de identidade (Azure Active Directory / EntraID, SSO, permissões de usuários) e implementação de ferramentas de segurança (EDR, scanners de vulnerabilidades).
* Domínio de **Terraform** para gerenciamento de estado e implantações modulares de infraestrutura e de **Ansible** para configuração automatizada, aplicação de atualizações e gerenciamento de servidores.
* Grande autonomia e habilidades de pensamento crítico, com foco em colaboração e capacidade de trabalhar em equipes multifuncionais.
* Excelentes habilidades de comunicação (escrita, escuta e fala), mentalidade colaborativa e atitude proativa.
* Fluência em inglês (obrigatório).
**Habilidades adicionais/desejáveis**
* Experiência com plataformas de orquestração de contêineres (Kubernetes / AKS).
* Domínio no gerenciamento de pipelines CI/CD usando GitLab e GitLab CI/CD.
* Familiaridade com a suíte Atlassian, especialmente JSM (Jira Service Management), para rastreamento de incidentes, solicitações e fluxos de trabalho.
* Experiência com pilhas de observabilidade (Prometheus, Grafana, Loki).
* Certificações relevantes, como Certified Azure Administrator (AZ\-104\).