
YellowIpe
Líder Sênior em Sistemas Distribuídos & SRE
17 de julho de 2026
Sobre a YellowIpe
A nossa missão é inspirar a conexão entre a tecnologia e as pessoas. Cultivamos o melhor nos nossos profissionais através da nossa experiência em encontrar e atrair os melhores talentos para os melhores projetos. Foco nas pessoas, Colaboração e Compromisso são os pilares que nos guiam nesta jornada.
Junte-se à equipa amarela como o nosso novo Líder Sênior em Sistemas Distribuídos & SRE:
Função:
Estamos à procura de um Líder Sênior em Sistemas Distribuídos & SRE experiente para se juntar a uma operação de infraestrutura em escala global que suporta um ecossistema altamente complexo com mais de 2.750 nós em várias tecnologias distribuídas, de bases de dados, de procura e de mensagens. Neste papel, você atuará como a camada de escalonamento técnico mais alta (L3), apoiando ambientes de produção críticos, resolvendo incidentes maiores, conduzindo análises de causas raízes e liderando iniciativas de automação para melhorar a confiabilidade, escalabilidade e eficiência operacional. Você trabalhará em estreita colaboração com as equipas de infraestrutura, plataforma, base de dados e engenharia, ajudando a moldar a excelência operacional em um ambiente de sistemas distribuídos de grande escala.
Responsabilidades:
- Garantir a estabilidade, disponibilidade e desempenho de sistemas distribuídos e plataformas de dados;
- Atuar como o principal ponto de escalonamento técnico (L3) para incidentes maiores envolvendo bases de dados distribuídas, plataformas de busca e sistemas de mensagens;
- Servir como um Especialista em Assunto em bases de dados relacionais, tecnologias NoSQL, motores de busca distribuídos e plataformas de mensagens;
- Liderar esforços complexos de solução de problemas e realizar análises profundas de causas raízes (RCA) para problemas recorrentes e interrupções de produção;
- Colaborar com equipas de engenharia em eventos importantes de ciclo de vida, incluindo atualizações, migrações, planeamento de capacidade e iniciativas de modernização de plataformas;
- Gerir a saúde, escalabilidade e otimização de clusters distribuídos, incluindo descomissionamento de nós, reequilíbrio e ajuste de desempenho;
- Definir e otimizar indexação, sharding e estratégias de busca em ambientes Elasticsearch, OpenSearch e Solr;
- Desenvolver e manter soluções de Infraestrutura como Código (IaC) utilizando Terraform e Ansible para padronizar implantações e procedimentos operacionais;
- Apoiar e manter ambientes de big data em grande escala; Conduzir iniciativas de automação para reduzir a sobrecarga operacional e melhorar a confiabilidade da plataforma;
- Participar de uma rotação de chamadas 24/7 e fornecer suporte durante intervenções planejadas nos fins de semana quando necessário.
Requisitos:
- Mais de 7 anos de experiência prática na gestão de sistemas distribuídos em grande escala;
- Experiência forte com:
- Apache Kafka
- Apache Cassandra
- Elasticsearch
- OpenSearch
- Apache Solr
- Experiência sólida com:
- Redis
- RabbitMQ
- MapR / ecossistemas Hadoop
- Administração de nível especialista em Linux/Unix;
- Fortes competências em scripting de shell (Bash);
- Experiência comprovada em construir soluções de automação com:
- Terraform
- Ansible
- Experiência na gestão de escalabilidade de clusters, ajuste de desempenho, gestão de ciclo de vida de nós e resposta a incidentes;
- Fortes habilidades de solução de problemas e analíticas em ambientes de produção complexos;
- Capacidade de liderar investigações técnicas e coordenar a resolução de incidentes críticos;
- Disponibilidade para participar de uma rotação de chamadas 24/7;
- Flexibilidade para trabalhar em horários rotativos quando necessário.
Desejável:
- Experiência com tecnologias de bases de dados relacionais como:
- Oracle
- PostgreSQL
- MySQL
- MariaDB
- Experiência em apoiar ecossistemas de bases de dados e mensagens em grandes ambientes empresariais;
- Conhecimento em práticas de padronização de infraestrutura e engenharia de plataformas;
- Experiência em mentoria de equipas e condução de iniciativas de excelência operacional;
- Disposição para expandir a especialização em múltiplas tecnologias dentro do ecossistema de plataforma.
Informação Importante:
- Modelo de trabalho híbrido em Almada ou Aveiro;
- Horário de trabalho alinhado com equipas internacionais (09:00–18:00 e/ou 14:00–23:00);
- Participação em uma rotação de chamadas é obrigatória;
- Intervenções nos fins de semana podem ser necessárias, compensadas através de horários flexíveis;
- Os candidatos devem residir em Portugal.
Candidate-se a esta oportunidade no nosso site! =)