YellowIpe

YellowIpe® é a sua consultoria para serviços profissionais de TI. Oferecemos as melhores soluções personalizadas para os requisitos e desafios do seu projeto tecnológico.
Sobre a empresa

Líder Sénior de Sistemas Distribuídos e SRE

Presencial

location

date 2 de setembro de 2026

Sobre a YellowIpe

A nossa missão é inspirar a conexão entre tecnologia e pessoas. Nutrímos o melhor nos nossos profissionais através da nossa experiência em encontrar e atrair os melhores talentos para os melhores projetos. Foco nas pessoas, colaboração e compromisso são os pilares que nos guiam nesta jornada.

Junte-se à equipa amarela como o nosso novo Líder Sénior de Sistemas Distribuídos e SRE:

Função:

Estamos à procura de um Líder Sénior de Sistemas Distribuídos e SRE experiente para se juntar a uma operação de infraestrutura em escala global que suporta um ecossistema altamente complexo de mais de 2.750 nós em várias tecnologias distribuídas, de base de dados, pesquisa e mensagens. Neste papel, atuará como a camada de escalonamento técnico mais elevada (L3), suportando ambientes de produção críticos, resolvendo incidentes maiores, conduzindo análises de causa raiz e liderando iniciativas de automação para melhorar a fiabilidade, escalabilidade e eficiência operacional. Trabalhará em estreita colaboração com as equipas de infraestrutura, plataforma, base de dados e engenharia, ajudando a moldar a excelência operacional em uma paisagem de sistemas distribuídos de grande escala.

Responsabilidades:

  • Garantir a estabilidade, disponibilidade e desempenho de sistemas distribuídos e plataformas de dados;
  • Actuar como o principal ponto de escalonamento técnico (L3) para incidentes maiores envolvendo bases de dados distribuídas, plataformas de pesquisa e sistemas de mensagens;
  • Servir como Especialista em Matéria em bases de dados relacionais, tecnologias NoSQL, motores de pesquisa distribuídos e plataformas de mensagens;
  • Liderar esforços de resolução de problemas complexos e realizar Análise de Causa Raiz (RCA) em problemas recorrentes e falhas na produção;
  • Colaborar com equipas de engenharia em eventos principais do ciclo de vida, incluindo atualizações, migrações, planeamento de capacidade e iniciativas de modernização de plataformas;
  • Gerir a saúde, escalabilidade e otimização de clusters distribuídos, incluindo desativação de nós, reequilíbrio e ajuste de desempenho;
  • Definir e otimizar estratégias de indexação, sharding e pesquisa em ambientes Elasticsearch, OpenSearch e Solr;
  • Desenvolver e manter soluções de Infraestrutura como Código (IaC) usando Terraform e Ansible para padronizar implantações e procedimentos operacionais;
  • Suportar e manter ambientes de big data em grande escala; Conduzir iniciativas de automação para reduzir sobrecarga operacional e melhorar a fiabilidade da plataforma;
  • Participar numa rotação de chamada 24/7 e fornecer suporte durante intervenções planeadas nos fins de semana, quando necessário.

Requisitos:

  • Mais de 7 anos de experiência prática na gestão de sistemas distribuídos em grande escala;
  • Fortes experiências com:
  • Apache Kafka
  • Apache Cassandra
  • Elasticsearch
  • OpenSearch
  • Apache Solr
  • Experiência sólida com:
  • Redis
  • RabbitMQ
  • MapR / ecossistemas Hadoop
  • Experiência em administração de Linux/Unix em nível de especialista;
  • Fortes habilidades em scripting de shell (Bash);
  • Experiência comprovada na construção de soluções de automação com:
  • Terraform
  • Ansible
  • Experiência em gerir escalabilidade de clusters, ajuste de desempenho, gestão de ciclo de vida de nós, e resposta a incidentes;
  • Fortes habilidades de resolução de problemas e analíticas em ambientes de produção complexos;
  • Capacidade para liderar investigações técnicas e coordenar a resolução de incidentes críticos;
  • Disponibilidade para participar em uma rotação de chamada 24/7;
  • Flexibilidade para trabalhar dentro de horários rotativos quando necessário.

Preferências:

  • Experiência com tecnologias de bases de dados relacionais, como:
  • Oracle
  • PostgreSQL
  • MySQL
  • MariaDB
  • Experiência em suportar tanto ecosistemas de base de dados quanto de mensagens em grandes ambientes empresariais;
  • Conhecimento sobre padronização de infraestrutura e práticas de engenharia de plataformas;
  • Experiência a mentorar equipas e a conduzir iniciativas de excelência operacional;
  • Vontade de expandir a expertise em várias tecnologias dentro do ecossistema da plataforma.

Informações Importantes:

  • Modelo de trabalho híbrido em Almada ou Aveiro;
  • Horário de trabalho alinhado com equipas internacionais (09:00–18:00 e/ou 14:00–23:00);
  • Participação em uma rotação de chamada é obrigatória;
  • Intervenções nos fins de semana podem ser necessárias, compensadas com horários flexíveis;
  • Os candidatos devem residir em Portugal.

Candidate-se a esta oportunidade no nosso site! =)

Contactos e Endereço