Descrição
Resumo:
A MEDvidi está buscando um Engenheiro Staff DevOps para impulsionar a visão de infraestrutura, garantindo confiabilidade, eficiência de custos, segurança e experiência do desenvolvedor em uma plataforma de saúde mental impulsionada por IA.
Pontos principais:
1. Propriedade real, do início ao fim, com foco em resultados mensuráveis
2. Liderança técnica sem sobrecarga gerencial, mantendo-se envolvido diretamente
3. Nativo de IA por padrão, integrando agentes autônomos à produção
**MEDvidi** é uma plataforma de saúde mental impulsionada por IA que estabelece um novo padrão para cuidados psiquiátricos seguros, eficazes e escaláveis nos Estados Unidos.
Combinamos profissionais licenciados com ferramentas proprietárias de IA para oferecer tratamento consistente e orientado por resultados para condições como TDAH, ansiedade, depressão e outras. A tecnologia da MEDvidi automatiza registros clínicos, acompanhamentos e planejamento de tratamento, liberando os profissionais para se concentrarem no atendimento ao paciente, ao mesmo tempo em que melhora a eficiência e a qualidade clínica.
Como nosso **Engenheiro Staff DevOps**, você decidirá para onde nossa infraestrutura seguirá em seguida e levará toda a equipe de engenharia nessa direção. Este é um cargo prático no sentido mais estrito: você define a direção técnica, implementa-a pessoalmente e assume responsabilidade pelos resultados em termos de confiabilidade, custos, segurança e experiência do desenvolvedor em toda a empresa. Você trabalhará em estreita parceria com nossas equipes de engenharia de produtos, integrado diretamente ao que elas estão construindo, eliminando atritos relacionados à infraestrutura e moldando-a com base nas reais necessidades dos produtos.
**Por que esta vaga**
* **Propriedade real, do início ao fim.** Você é responsável por resultados, não por tarefas, incluindo suas próprias métricas. Confiabilidade, custos, desempenho, saúde das implantações e velocidade dos desenvolvedores são de sua responsabilidade: você define as metas e apresenta proativamente os dados correspondentes.
* **Liderança técnica sem a sobrecarga gerencial.** Liderança baseada em expertise e iniciativa, onde os engenheiros mais seniores também estão diretamente envolvidos no código. Você define a direção e eleva o nível técnico, mantendo-se profundamente envolvido na prática.
* **Nativo de IA por padrão.** A IA agente é parte fundamental de nosso modo de trabalho. Você delegará tarefas a agentes autônomos, integrará suas saídas às mudanças em produção e ajudará a moldar a forma como toda a organização constrói com IA.
Requisitos:
* 6 anos ou mais em engenharia DevOps/infraestrutura, com sólidos fundamentos em sistemas e administração e solução de problemas em Linux (análise de desempenho, gerenciamento de recursos, depuração de processos).
* Experiência prática com AWS (EC2, EKS, RDS, ElastiCache, Lambda, SQS, EventBridge, API Gateway, ALB, S3) e Kubernetes/EKS em produção (gerenciamento de clusters, dimensionamento automático de nós, aplicação de políticas; Karpenter, Kyverno ou similar).
* Domínio sólido de Infraestrutura como Código (Terraform e AWS CDK em TypeScript) e responsabilidade integral por CI/CD (GitLab CI/CD: modelos reutilizáveis/compartilhados, tokens id\_tokens OIDC, GitLab auto-gerenciado).
* Monitoramento e observabilidade na prática (Prometheus, Grafana, OpenTelemetry, OpenSearch, CloudWatch; envio de logs e rastreamento de erros/APM).
* Engenharia de segurança prática (rotação de segredos, credenciais de curta duração, varredura de vazamentos, logs conscientes de PHI) e HashiCorp Vault como código (KV, autenticação JWT/OIDC para CI, design de políticas).
* Implantações blue-green com rollback automatizado e condicionado à saúde do sistema; migrações de esquema PostgreSQL sem tempo de inatividade (expandir/contrair) e controle de migrações no CI.
* Containers (Docker, ECR, tags imutáveis, ciclo de vida de imagens) e fundamentos de rede/protocolos (balanceamento de carga, TLS, DNS).
* Experiência prática com fluxos de trabalho de IA agente (Claude Code ou similar): delegação a agentes autônomos e integração de suas saídas à produção.
* Mentalidade centrada no desenvolvedor, forte capacidade de resolução de problemas em sistemas complexos e excelente redação técnica (documentação como código, ADRs, documentos de arquitetura via MRs).
* Fluência em russo e inglês (nível B2\).
* Experiência eficaz em equipes remotas e distribuídas.
**Seria um diferencial**
* Experiência em ambientes regulados ou com alta exigência de conformidade (HIPAA, SOC 2 ou similar).
* Gerenciamento de configuração (Ansible) para gestão de frotas de máquinas virtuais.
* Operações de aplicações Node.js (pm2, npm); nossa pilha é Node.js \+ TypeScript.
* Ferramentas GitOps (ArgoCD, Flux) e administração avançada de bancos de dados PostgreSQL.
* Certificações AWS.
Responsabilidades:
* Definir e impulsionar proativamente a visão técnica e a roadmap trimestral de nossa infraestrutura, com trade-offs claros e metas mensuráveis.
* Operar e evoluir nossa infraestrutura AWS \+ Kubernetes (EKS): gerenciamento de clusters, dimensionamento automático (Karpenter), aplicação de políticas (Kyverno) e operações sem tempo de inatividade.
* Assumir responsabilidade integral pela Infraestrutura como Código (Terraform, AWS CDK em TypeScript) e pelo nosso GitLab CI/CD (modelos reutilizáveis/compartilhados, OIDC, GitLab auto-gerenciado).
* Construir e manter observabilidade realmente utilizada pelas equipes (Prometheus, Grafana, OpenTelemetry, OpenSearch, CloudWatch; pipelines de logs, APM) — uma visão compartilhada da saúde do sistema, não um dashboard que ninguém abre.
* Manter implantações blue-green e rollbacks automatizados condicionados à saúde do sistema rápidos e previsíveis; assumir responsabilidade por migrações de esquema PostgreSQL sem tempo de inatividade (expandir/contrair) e controle de migrações no CI.
* Assumir responsabilidade pela engenharia de segurança em um ambiente HIPAA: boas práticas com segredos (rotação, credenciais de curta duração, varredura de vazamentos), tratamento consciente de logs e dados contendo PHI, além de gerenciamento do Vault como código.
* Trabalhar diretamente com equipes de produto para eliminar atritos de infraestrutura e melhorar a experiência do desenvolvedor por design.
* Utilizar IA agente como parte central de seu fluxo de trabalho, integrando saídas de agentes autônomos à produção.
O que oferecemos:
* **Ambiente de alto impacto:** Uma oportunidade de contribuir para uma empresa orientada a produtos no setor de tecnologia médica.
* **Crescimento \& remuneração:** Oportunidades claras de crescimento e um pacote remuneratório competitivo.
* **Remoto desde o início:** Colaboração totalmente remota de longo prazo sob modelo B2B.
* **Saúde \& bem-estar:** Plano de saúde após o período de experiência, além de benefício esportes \& bem-estar.
* **Desenvolvimento profissional:** Oportunidades claras de crescimento, incluindo aulas personalizadas de inglês via Preply.
* **Folga:** 19 dias úteis de férias remuneradas anualmente, 4 dias adicionais de bem-estar por ano e licença médica remunerada pelos primeiros 5 dias úteis.
* **Cultura:** Presentes cuidadosamente escolhidos para eventos importantes da vida e eventos corporativos presenciais.
**Pronto para causar impacto? Envie-nos seu perfil, vamos construir algo significativo juntos.**
*A MEDvidi é uma Empregadora que Oferece Igualdade de Oportunidades. Celebramos a diversidade e estamos comprometidos em criar um ambiente inclusivo para todos os funcionários e contratados. Todos os candidatos qualificados serão considerados sem distinção de raça, cor, religião, sexo, orientação sexual, identidade de gênero, origem nacional, deficiência ou condição de veterano.*