Descrição
Resumo:
Procuramos membros fundadores da equipe de SRE para garantir a confiabilidade, desempenho e disponibilidade das instâncias do Develocity e da infraestrutura de suporte para organizações de software líderes.
Pontos de destaque:
1. Modelar como uma nova equipe de SRE opera com um papel de fundação
2. Propriedade real de sistemas de produção utilizados por engenheiros em empresas líderes
3. Cultura que valoriza a automação em vez de atos heroicos
**Quem Somos**
--------------
A IA está mudando a forma como o software é desenvolvido. A produção de código está se tornando uma commodity. O foco está migrando da escrita de código para a orquestração, verificação e governança de mudanças – e a cadeia de ferramentas é agora a nova restrição.
Estamos no centro dessa mudança. Desenvolvemos o Develocity, uma plataforma de observabilidade e inteligência para cadeias de ferramentas usada por algumas das principais organizações de software do mundo – Netflix, Airbnb, Spotify, SAP, grandes bancos globais e centenas de outras. O Develocity ajuda equipes de software a alcançar excelência na entrega por meio de observabilidade profunda, aceleração de compilação e testes, e inteligência impulsionada por IA em toda a cadeia de ferramentas – com suporte atual para Gradle Build Tool, Apache Maven™, sbt, npm e Python.
Somos uma empresa nativa de IA. A IA não é um recurso que estamos adicionando posteriormente – ela é central à forma como trabalhamos, como pensamos sobre nosso produto e para onde nos dirigimos. Estamos investindo profundamente para tornar os dados únicos do Develocity e décadas de experiência de domínio acessíveis tanto a humanos quanto a agentes de IA, com confiança, evidência e explicabilidade no cerne de tudo o que construímos.
Parcerias foram estabelecidas com a Apache Software Foundation, a Commonhaus Foundation, a Micronaut Foundation e outros projetos de código aberto, como Spring, Quarkus, Kotlin, JUnit, AndroidX, entre muitos outros, para levar também à comunidade de código aberto os valores do Develocity.
**Nossos Valores**
**Buscar Compreender:** Tudo começa com escuta e compreensão, e esforçamo-nos para entender diferentes pontos de vista, problemas e motivações. Antes de tomarmos qualquer ação, asseguramo-nos de realmente compreender os desafios, perspectivas e objetivos.
**Conhecer o Porquê:** Abordamos nosso trabalho com um claro senso de propósito, garantindo que cada etapa seja deliberada e focada. Tomamos ações significativas com urgência, mas nunca à custa de uma reflexão cuidadosa.
**Inovar \& Iterar:** Aceitamos desafios e não temos medo de experimentar coisas novas, mesmo que possam falhar. Com uma compreensão profunda e um propósito claro, podemos desenvolver soluções criativas e ousadas para enfrentar desafios.
**Assumir o Resultado:** Temos autonomia para tomar iniciativas e mantemos transparência em nosso trabalho e em seus resultados. Ao executar, assumimos a responsabilidade por nossas decisões, medimos o sucesso de nossas inovações e aprendemos com os resultados.
**Quem Você É**
---------------
Estamos formando uma nova equipe de SRE e buscamos membros fundadores para ajudar a moldar nossa forma de operar. Você será responsável pela confiabilidade, desempenho e disponibilidade das instâncias do Develocity que atendem clientes pagantes, projetos de código aberto e serviços voltados ao público, além da infraestrutura de suporte, como registros de artefatos.
Você trabalhará em nossa Plataforma de Aplicativos em Nuvem desenvolvida internamente, Kubernetes na AWS e desenvolverá expertise profunda nessa plataforma. Quando ocorrerem incidentes, você fará a depuração de problemas em toda a pilha, desde a aplicação até a infraestrutura. Você colaborará com a equipe de Plataforma em Nuvem para melhorar as ferramentas das quais depende e com equipes de engenharia para incorporar confiabilidade ao modo como entregamos software. Se você gosta de automatizar tarefas e odeia repetir a mesma tarefa duas vezes, certamente se encaixará bem.
Você fará parte de uma equipe distribuída e remota desde o início, que valoriza a comunicação assíncrona e a documentação escrita. Uma forte capacidade de autodireção e uma comunicação clara através de fusos horários são essenciais.
**Responsabilidades**
--------------------
* Operar e manter todas as instâncias do Develocity e serviços de suporte.
* Participar de uma rotação de plantão "siga-o-sol", assumindo a resposta a incidentes e a depuração de problemas em toda a pilha.
* Impulsionar a automação em implantações de aplicações, atualizações, monitoramento, autorrecuperação e recuperação.
* Construir e manter a observabilidade para todos os serviços gerenciados (registros de eventos, métricas, rastreamento e alertas).
* Trabalhar com equipes de engenharia para incorporar confiabilidade às funcionalidades desde o início.
* Gerenciar respostas a incidentes e retrospectivas, garantindo que aprendamos com elas.
* Assumir a responsabilidade pela recuperação de desastres, backups e continuidade dos negócios.
* Comunicar-se com os clientes durante incidentes e janelas de manutenção.
* Otimizar desempenho, uso de recursos e custos.
* Auxiliar na evolução de nossas operações SaaS à medida que crescemos.
**Qualificações mínimas**
--------------------------
* 5 ou mais anos em SRE, DevOps ou função equivalente operando serviços de produção em larga escala.
* Experiência sólida com Kubernetes em ambientes de produção.
* Conhecimento especializado em infraestrutura em nuvem, preferencialmente AWS (EKS, RDS, S3, EC2\).
* Domínio de ferramentas de observabilidade (Prometheus, Grafana) e de Infraestrutura como Código (Terraform).
* Histórico comprovado de gerenciamento e resposta a incidentes.
* Conhecimento das melhores práticas de SRE (SLAs, SLOs).
* Proficiência em scripts (Python, Bash) para automação.
* Experiência com rodízios de plantão 24/7.
* Excelentes habilidades de comunicação escrita e verbal em inglês.
**Qualificações desejáveis**
----------------------------
* Experiência operando plataformas SaaS em larga escala.
* Familiaridade com o Develocity.
* Experiência com linguagens JVM (Java, Kotlin).
* Experiência em planejamento e execução de recuperação de desastres.
* Habilidades de comunicação com clientes durante incidentes.
* Experiência em estabelecer práticas de SRE em equipes novas ou em crescimento.
**O Que Oferecemos**
-----------------
* Um papel de fundação em uma nova equipe de SRE – você moldará nossa forma de agir, em vez de herdar decisões de outra pessoa.
* Propriedade real de sistemas de produção utilizados por engenheiros em empresas conhecidas.
* Interação direta com clientes quando algo dá errado (e também quando dá certo).
* Uma cultura que valoriza a automação em vez de atos heroicos.
* Reuniões presenciais, como nosso evento anual da empresa e reuniões de equipe.
* Trabalho remoto em um ambiente que prioriza o trabalho remoto desde o início.
* Salários competitivos e concessões de participação acionária.
**Localização**
------------
* Remoto de qualquer lugar na Europa no fuso horário GMT.
* Embora nossa equipe trabalhe remotamente e esteja espalhada pelo globo, valorizamos profundamente as interações diárias e a colaboração.