
YellowIpe
Líder Sénior de Sistemas Distribuídos e SRE
2 de setembro de 2026
Sobre a YellowIpe
A nossa missão é inspirar a conexão entre tecnologia e pessoas. Nutrímos o melhor nos nossos profissionais através da nossa experiência em encontrar e atrair os melhores talentos para os melhores projetos. Foco nas pessoas, colaboração e compromisso são os pilares que nos guiam nesta jornada.
Junte-se à equipa amarela como o nosso novo Líder Sénior de Sistemas Distribuídos e SRE:
Função:
Estamos à procura de um Líder Sénior de Sistemas Distribuídos e SRE experiente para se juntar a uma operação de infraestrutura em escala global que suporta um ecossistema altamente complexo de mais de 2.750 nós em várias tecnologias distribuídas, de base de dados, pesquisa e mensagens. Neste papel, atuará como a camada de escalonamento técnico mais elevada (L3), suportando ambientes de produção críticos, resolvendo incidentes maiores, conduzindo análises de causa raiz e liderando iniciativas de automação para melhorar a fiabilidade, escalabilidade e eficiência operacional. Trabalhará em estreita colaboração com as equipas de infraestrutura, plataforma, base de dados e engenharia, ajudando a moldar a excelência operacional em uma paisagem de sistemas distribuídos de grande escala.
Responsabilidades:
- Garantir a estabilidade, disponibilidade e desempenho de sistemas distribuídos e plataformas de dados;
- Actuar como o principal ponto de escalonamento técnico (L3) para incidentes maiores envolvendo bases de dados distribuídas, plataformas de pesquisa e sistemas de mensagens;
- Servir como Especialista em Matéria em bases de dados relacionais, tecnologias NoSQL, motores de pesquisa distribuídos e plataformas de mensagens;
- Liderar esforços de resolução de problemas complexos e realizar Análise de Causa Raiz (RCA) em problemas recorrentes e falhas na produção;
- Colaborar com equipas de engenharia em eventos principais do ciclo de vida, incluindo atualizações, migrações, planeamento de capacidade e iniciativas de modernização de plataformas;
- Gerir a saúde, escalabilidade e otimização de clusters distribuídos, incluindo desativação de nós, reequilíbrio e ajuste de desempenho;
- Definir e otimizar estratégias de indexação, sharding e pesquisa em ambientes Elasticsearch, OpenSearch e Solr;
- Desenvolver e manter soluções de Infraestrutura como Código (IaC) usando Terraform e Ansible para padronizar implantações e procedimentos operacionais;
- Suportar e manter ambientes de big data em grande escala; Conduzir iniciativas de automação para reduzir sobrecarga operacional e melhorar a fiabilidade da plataforma;
- Participar numa rotação de chamada 24/7 e fornecer suporte durante intervenções planeadas nos fins de semana, quando necessário.
Requisitos:
- Mais de 7 anos de experiência prática na gestão de sistemas distribuídos em grande escala;
- Fortes experiências com:
- Apache Kafka
- Apache Cassandra
- Elasticsearch
- OpenSearch
- Apache Solr
- Experiência sólida com:
- Redis
- RabbitMQ
- MapR / ecossistemas Hadoop
- Experiência em administração de Linux/Unix em nível de especialista;
- Fortes habilidades em scripting de shell (Bash);
- Experiência comprovada na construção de soluções de automação com:
- Terraform
- Ansible
- Experiência em gerir escalabilidade de clusters, ajuste de desempenho, gestão de ciclo de vida de nós, e resposta a incidentes;
- Fortes habilidades de resolução de problemas e analíticas em ambientes de produção complexos;
- Capacidade para liderar investigações técnicas e coordenar a resolução de incidentes críticos;
- Disponibilidade para participar em uma rotação de chamada 24/7;
- Flexibilidade para trabalhar dentro de horários rotativos quando necessário.
Preferências:
- Experiência com tecnologias de bases de dados relacionais, como:
- Oracle
- PostgreSQL
- MySQL
- MariaDB
- Experiência em suportar tanto ecosistemas de base de dados quanto de mensagens em grandes ambientes empresariais;
- Conhecimento sobre padronização de infraestrutura e práticas de engenharia de plataformas;
- Experiência a mentorar equipas e a conduzir iniciativas de excelência operacional;
- Vontade de expandir a expertise em várias tecnologias dentro do ecossistema da plataforma.
Informações Importantes:
- Modelo de trabalho híbrido em Almada ou Aveiro;
- Horário de trabalho alinhado com equipas internacionais (09:00–18:00 e/ou 14:00–23:00);
- Participação em uma rotação de chamada é obrigatória;
- Intervenções nos fins de semana podem ser necessárias, compensadas com horários flexíveis;
- Os candidatos devem residir em Portugal.
Candidate-se a esta oportunidade no nosso site! =)