Descrição
Resumo da Vaga:
Procuramos um Cloud Support Infrastructure Expert para suporte a ambientes críticos de produção, focado na disponibilidade, estabilidade e melhoria contínua dos serviços.
Principais Destaques:
1. Suporte a ambientes críticos de produção e automação de infraestruturas.
2. Promove um ambiente de trabalho positivo e inclusivo.
3. Foco em inovação e excelência.
**Sobre Nós:**
Na Sourcing Trust, comprometemo\-nos a fornecer soluções tecnológicas inovadoras, fiáveis e personalizadas que capacitam as empresas a prosperar num panorama digital em rápida evolução. Com foco na excelência, integridade e colaboração, construímos parcerias duradouras através da compreensão das necessidades únicas de cada cliente e da oferta de suporte especializado em todas as fases. A nossa equipa dedica\-se a promover um ambiente de trabalho positivo e inclusivo, onde a contribuição de cada colaborador é valorizada, incentivando o crescimento contínuo, a aprendizagem e o sucesso partilhado. Junte\-se a nós e faça parte de uma organização apaixonada, impulsionada pela inovação e pela excelência.
**Sobre a vaga:**
Estamos à procura de um **Cloud Support Infrastructure Expert** para integrar um projeto nacional, assumindo um papel fundamental no suporte a ambientes críticos de produção. Procuramos um profissional com experiência em operações cloud, automação de infraestruturas e suporte aplicacional, capaz de garantir a disponibilidade, estabilidade e melhoria contínua dos serviços.
**Principais Responsabilidades:**
* Assegurar o suporte aplicacional em produção para plataformas e ferramentas de dados;
* Monitorizar serviços, analisar logs de sistemas, middleware e aplicações, identificando e resolvendo potenciais problemas;
* Garantir a monitorização contínua, reporting e melhoria da qualidade e disponibilidade dos serviços;
* Desenvolver e manter **playbooks Ansible** e **scripts Terraform** para automatizar processos de provisionamento, configuração e deployment;
* Apoiar e formar outros elementos da equipa na utilização de **Ansible, Docker e Kubernetes**;
* Cumprir os níveis de serviço (SLA/SLO) definidos para incidentes e pedidos;
* Criar e manter documentação técnica e artigos de conhecimento para suporte aplicacional;
* Participar numa equipa de suporte **24x7**, incluindo regime de turnos, prevenção, fins de semana e feriados;
* Participar em testes de **Disaster Recovery (DR)** e exercícios de continuidade de serviço;
* Validar sessões de transferência de conhecimento realizadas pelas equipas de desenvolvimento;
* Colaborar com equipas de desenvolvimento e operações para garantir a estabilidade dos ambientes de produção;
* Contribuir para iniciativas de automação, melhoria contínua e redução dos tempos de deteção e resolução de incidentes.
**Requisitos:**
* Mestrado em **Engenharia Informática, Ciências da Computação** ou área equivalente;
* Experiência mínima de **5 anos** em **IT Operations** ou **Software Engineering**;
* Experiência mínima de **2 anos** com pelo menos um fornecedor de cloud pública (**IBM Cloud, AWS, Azure ou Google Cloud**);
* Experiência prática mínima de **2 anos** com **Ansible** e **Docker**;
* Conhecimentos sólidos de **Linux**, linha de comandos (CLI) e **Shell Scripting**;
* Experiência em linguagens de scripting, preferencialmente **Python** e/ou **Bash**;
* Experiência em automação de infraestruturas com **Ansible** e **Terraform**;
* Conhecimentos de **Kubernetes** e ambientes containerizados;
* Experiência com ferramentas de **Integração Contínua (CI)**, como **Jenkins, Travis CI, Concourse** ou similares;
* Conhecimentos de boas práticas **ITIL**;
* Fluência em **Inglês** (falado e escrito).
**Valorizamos ainda:**
* Certificação **Red Hat Enterprise Linux Automation with Ansible (RH294\)**;
* Certificação **Certified Kubernetes Application Developer (CKAD)**;
* Certificação **Developing Advanced Automation with Red Hat Ansible Automation Platform (DO374\)**;
* Certificação **HashiCorp Terraform Associate**;
* Certificação **HashiCorp Vault Associate**;
* Experiência em ambientes críticos de produção e suporte de elevada disponibilidade;
* Capacidade de análise, resolução de problemas, colaboração e melhoria contínua.
Localização do trabalho: Trabalho remoto híbrido em Lisboa