Descrição
Resumo:
Junte-se à equipe avançada de engenharia da Tieto Iberia como Engenheiro de Operações de Machine Learning/Modelos de Linguagem para projetar, construir e operar infraestrutura de ponta a ponta para sistemas de IA em produção.
Pontos principais:
1. Projetar e implementar pipelines de ingestão escaláveis para dados de ML e LLM.
2. Desenvolver ferramentas de observabilidade e depuração para sistemas de IA em produção.
3. Assumir a responsabilidade pela confiabilidade operacional dos pipelines de dados e avaliação de ML/LLM.
**Descrição da vaga**
A Tieto Iberia faz parte do Grupo Tieto e combina experiência local com a força global da Tieto, uma empresa líder em serviços de software e engenharia digital com presença e capacidades mundiais.
Como parte de nossa contínua expansão em plataformas impulsionadas por IA e sistemas intensivos em dados, procuramos um **Engenheiro de Operações de Machine Learning/Operações de Modelos de Linguagem** para integrar nossa equipe avançada de engenharia. Neste cargo, você será responsável por projetar, construir e operar a infraestrutura de ponta a ponta que suporta sistemas de IA em produção, garantindo confiabilidade, observabilidade, qualidade dos dados e melhoria contínua de soluções baseadas em machine learning e LLM.
Principais responsabilidades
* Projetar e implementar pipelines de ingestão escaláveis e independentes da fonte para dados de ML e LLM em produção.
* Construir e manter fluxos de processamento de dados, incluindo ingestão, redação, armazenamento, classificação e segmentação de sinais em produção.
* Definir e implementar estratégias de armazenamento de dados, incluindo camadas, políticas de retenção e tratamento de dados com atenção à privacidade.
* Desenvolver ferramentas de observabilidade e depuração, incluindo dashboards e sistemas de consulta para sistemas de IA em produção.
* Implementar estruturas de avaliação e monitoramento, incluindo conjuntos de avaliação offline, autoraters online e sistemas de detecção de regressão.
* Construir sistemas automatizados de triagem para identificar, classificar e destacar falhas em produção.
* Desenvolver e manter mecanismos de redação de PII e aplicar políticas de governança e conformidade de dados no nível de ingestão.
* Projetar e operar fluxos de mineração de avaliação de LLM para melhorar continuamente o desempenho de modelos e prompts.
* Implementar sistemas de alerta para detectar regressões nas implantações de modelos e prompts.
* Colaborar com equipes de IA, engenharia e produtos para garantir a robustez e confiabilidade dos sistemas de IA em produção.
* Avaliar e selecionar ferramentas, infraestrutura e estratégias de hospedagem para plataformas de ML/LLM.
* Assumir a responsabilidade pela confiabilidade operacional de todo o pipeline de dados e avaliação de ML/LLM.
Requisitos
* Experiência comprovada na construção e operação de plataformas de dados ou sistemas de ML em produção, incluindo ingestão, armazenamento, controle de acesso, monitoramento e responsabilidades de plantão.
* Experiência prática no desenvolvimento de sistemas de avaliação de ML/LLM (por exemplo, conjuntos de testes de regressão, autoraters, frameworks de LLM como juiz ou conjuntos de dados de referência).
* Sólida compreensão de ferramentas de observabilidade, rastreamento e depuração de LLM.
* Experiência na implementação de controles de privacidade de dados, como redação de PII em ambientes de produção.
* Profundo conhecimento dos modos de falha em sistemas de ML e LLM (alucinações, falhas de recuperação, loops de agentes, degradação de ASR/TTS, regressões em prompts/modelos).
* Fortes habilidades práticas de engenharia em Python em nível de produção, com mentalidade prática.
* Sólida compreensão de pipelines de dados, confiabilidade de sistemas e processamento distribuído de dados.
Habilidades desejáveis
* Experiência em arquiteturas multi-inquilino ou SaaS com requisitos rigorosos de isolamento de dados.
* Familiaridade com os ecossistemas em nuvem da Azure e/ou AWS.
* Experiência em tomadas de decisões sobre trade-offs de infraestrutura entre serviços gerenciados e soluções auto-hospedadas.
* Conhecimento de bancos de dados vetoriais, técnicas de incorporação (embedding) e métodos de detecção de falhas não supervisionados ou por agrupamento (clustering).
* Experiência com ferramentas de versionamento de dados, como LakeFS, DVC ou Delta Lake.
* Familiaridade com o GDPR, fluxos de exclusão de dados e sistemas de dados orientados à conformidade.
* Exposição a ambientes embarcados, automotivos ou restritos.
* Experiência em avaliação de modelos de linguagem em línguas diferentes do inglês ou com conjuntos de dados multilíngues.
* Experiência no trabalho com APIs de LLM, como Anthropic Claude, modelos da OpenAI ou alternativas de código aberto.
* Familiaridade com fluxos de CI/CD, desenvolvimento baseado no GitHub e práticas modernas de DevOps.
* Experiência no desenvolvimento de dashboards usando TypeScript ou tecnologias front-end similares.
**Informações adicionais**
Na Tieto, acreditamos no poder da diversidade, equidade e inclusão. Incentivamos candidatos de todas as origens, gêneros (m/f/d) e trajetórias de vida a se juntarem à nossa equipe, pois acreditamos que isso fomenta um ambiente de trabalho inspirador e impulsiona a inovação. Nosso compromisso com a abertura, a confiança e a diversidade está no cerne de nossa missão de criar futuros digitais que beneficiem empresas, sociedades e a humanidade.
Diversidade, equidade e inclusão \| Sustentabilidade \| Tieto