Engenheiro Senior de Confiabilidade de Sites

Indeed

Empresa

Tipo de empregoTempo Integral
Modalidade de TrabalhoPresencial
Nível de ExperiênciaSem Limite de Experiência
Nível de EducaçãoSem Limite de Formação

Descrição

Resumo: Procuramos membros fundadores da equipe de SRE para garantir a confiabilidade, desempenho e disponibilidade das instâncias do Develocity e da infraestrutura de suporte para organizações de software líderes. Pontos de destaque: 1. Modelar como uma nova equipe de SRE opera com um papel de fundação 2. Propriedade real de sistemas de produção utilizados por engenheiros em empresas líderes 3. Cultura que valoriza a automação em vez de atos heroicos **Quem Somos** -------------- A IA está mudando a forma como o software é desenvolvido. A produção de código está se tornando uma commodity. O foco está migrando da escrita de código para a orquestração, verificação e governança de mudanças – e a cadeia de ferramentas é agora a nova restrição. Estamos no centro dessa mudança. Desenvolvemos o Develocity, uma plataforma de observabilidade e inteligência para cadeias de ferramentas usada por algumas das principais organizações de software do mundo – Netflix, Airbnb, Spotify, SAP, grandes bancos globais e centenas de outras. O Develocity ajuda equipes de software a alcançar excelência na entrega por meio de observabilidade profunda, aceleração de compilação e testes, e inteligência impulsionada por IA em toda a cadeia de ferramentas – com suporte atual para Gradle Build Tool, Apache Maven™, sbt, npm e Python. Somos uma empresa nativa de IA. A IA não é um recurso que estamos adicionando posteriormente – ela é central à forma como trabalhamos, como pensamos sobre nosso produto e para onde nos dirigimos. Estamos investindo profundamente para tornar os dados únicos do Develocity e décadas de experiência de domínio acessíveis tanto a humanos quanto a agentes de IA, com confiança, evidência e explicabilidade no cerne de tudo o que construímos. Parcerias foram estabelecidas com a Apache Software Foundation, a Commonhaus Foundation, a Micronaut Foundation e outros projetos de código aberto, como Spring, Quarkus, Kotlin, JUnit, AndroidX, entre muitos outros, para levar também à comunidade de código aberto os valores do Develocity. **Nossos Valores** **Buscar Compreender:** Tudo começa com escuta e compreensão, e esforçamo-nos para entender diferentes pontos de vista, problemas e motivações. Antes de tomarmos qualquer ação, asseguramo-nos de realmente compreender os desafios, perspectivas e objetivos. **Conhecer o Porquê:** Abordamos nosso trabalho com um claro senso de propósito, garantindo que cada etapa seja deliberada e focada. Tomamos ações significativas com urgência, mas nunca à custa de uma reflexão cuidadosa. **Inovar \& Iterar:** Aceitamos desafios e não temos medo de experimentar coisas novas, mesmo que possam falhar. Com uma compreensão profunda e um propósito claro, podemos desenvolver soluções criativas e ousadas para enfrentar desafios. **Assumir o Resultado:** Temos autonomia para tomar iniciativas e mantemos transparência em nosso trabalho e em seus resultados. Ao executar, assumimos a responsabilidade por nossas decisões, medimos o sucesso de nossas inovações e aprendemos com os resultados. **Quem Você É** --------------- Estamos formando uma nova equipe de SRE e buscamos membros fundadores para ajudar a moldar nossa forma de operar. Você será responsável pela confiabilidade, desempenho e disponibilidade das instâncias do Develocity que atendem clientes pagantes, projetos de código aberto e serviços voltados ao público, além da infraestrutura de suporte, como registros de artefatos. Você trabalhará em nossa Plataforma de Aplicativos em Nuvem desenvolvida internamente, Kubernetes na AWS e desenvolverá expertise profunda nessa plataforma. Quando ocorrerem incidentes, você fará a depuração de problemas em toda a pilha, desde a aplicação até a infraestrutura. Você colaborará com a equipe de Plataforma em Nuvem para melhorar as ferramentas das quais depende e com equipes de engenharia para incorporar confiabilidade ao modo como entregamos software. Se você gosta de automatizar tarefas e odeia repetir a mesma tarefa duas vezes, certamente se encaixará bem. Você fará parte de uma equipe distribuída e remota desde o início, que valoriza a comunicação assíncrona e a documentação escrita. Uma forte capacidade de autodireção e uma comunicação clara através de fusos horários são essenciais. **Responsabilidades** -------------------- * Operar e manter todas as instâncias do Develocity e serviços de suporte. * Participar de uma rotação de plantão "siga-o-sol", assumindo a resposta a incidentes e a depuração de problemas em toda a pilha. * Impulsionar a automação em implantações de aplicações, atualizações, monitoramento, autorrecuperação e recuperação. * Construir e manter a observabilidade para todos os serviços gerenciados (registros de eventos, métricas, rastreamento e alertas). * Trabalhar com equipes de engenharia para incorporar confiabilidade às funcionalidades desde o início. * Gerenciar respostas a incidentes e retrospectivas, garantindo que aprendamos com elas. * Assumir a responsabilidade pela recuperação de desastres, backups e continuidade dos negócios. * Comunicar-se com os clientes durante incidentes e janelas de manutenção. * Otimizar desempenho, uso de recursos e custos. * Auxiliar na evolução de nossas operações SaaS à medida que crescemos. **Qualificações mínimas** -------------------------- * 5 ou mais anos em SRE, DevOps ou função equivalente operando serviços de produção em larga escala. * Experiência sólida com Kubernetes em ambientes de produção. * Conhecimento especializado em infraestrutura em nuvem, preferencialmente AWS (EKS, RDS, S3, EC2\). * Domínio de ferramentas de observabilidade (Prometheus, Grafana) e de Infraestrutura como Código (Terraform). * Histórico comprovado de gerenciamento e resposta a incidentes. * Conhecimento das melhores práticas de SRE (SLAs, SLOs). * Proficiência em scripts (Python, Bash) para automação. * Experiência com rodízios de plantão 24/7. * Excelentes habilidades de comunicação escrita e verbal em inglês. **Qualificações desejáveis** ---------------------------- * Experiência operando plataformas SaaS em larga escala. * Familiaridade com o Develocity. * Experiência com linguagens JVM (Java, Kotlin). * Experiência em planejamento e execução de recuperação de desastres. * Habilidades de comunicação com clientes durante incidentes. * Experiência em estabelecer práticas de SRE em equipes novas ou em crescimento. **O Que Oferecemos** ----------------- * Um papel de fundação em uma nova equipe de SRE – você moldará nossa forma de agir, em vez de herdar decisões de outra pessoa. * Propriedade real de sistemas de produção utilizados por engenheiros em empresas conhecidas. * Interação direta com clientes quando algo dá errado (e também quando dá certo). * Uma cultura que valoriza a automação em vez de atos heroicos. * Reuniões presenciais, como nosso evento anual da empresa e reuniões de equipe. * Trabalho remoto em um ambiente que prioriza o trabalho remoto desde o início. * Salários competitivos e concessões de participação acionária. **Localização** ------------ * Remoto de qualquer lugar na Europa no fuso horário GMT. * Embora nossa equipe trabalhe remotamente e esteja espalhada pelo globo, valorizamos profundamente as interações diárias e a colaboração.

Alguns conteúdos foram traduzidos automaticamente pelo sistema

Publicado por

João Santos

Indeed · HR

Localização

João Santos

Indeed · HR

Vagas semelhantes

Engenheiro Senior de Confiabilidade de Sites da Indeed em 2026 | ok.com