YellowIpe

YellowIpe® é a sua consultoria para serviços profissionais de TI. Oferecemos as melhores soluções personalizadas para os requisitos e desafios do seu projeto tecnológico.
Sobre a empresa

Líder Sênior em Sistemas Distribuídos & SRE

Presencial

location

date 17 de julho de 2026

Sobre a YellowIpe

A nossa missão é inspirar a conexão entre a tecnologia e as pessoas. Cultivamos o melhor nos nossos profissionais através da nossa experiência em encontrar e atrair os melhores talentos para os melhores projetos. Foco nas pessoas, Colaboração e Compromisso são os pilares que nos guiam nesta jornada.

Junte-se à equipa amarela como o nosso novo Líder Sênior em Sistemas Distribuídos & SRE:

Função:

Estamos à procura de um Líder Sênior em Sistemas Distribuídos & SRE experiente para se juntar a uma operação de infraestrutura em escala global que suporta um ecossistema altamente complexo com mais de 2.750 nós em várias tecnologias distribuídas, de bases de dados, de procura e de mensagens. Neste papel, você atuará como a camada de escalonamento técnico mais alta (L3), apoiando ambientes de produção críticos, resolvendo incidentes maiores, conduzindo análises de causas raízes e liderando iniciativas de automação para melhorar a confiabilidade, escalabilidade e eficiência operacional. Você trabalhará em estreita colaboração com as equipas de infraestrutura, plataforma, base de dados e engenharia, ajudando a moldar a excelência operacional em um ambiente de sistemas distribuídos de grande escala.

Responsabilidades:

  • Garantir a estabilidade, disponibilidade e desempenho de sistemas distribuídos e plataformas de dados;
  • Atuar como o principal ponto de escalonamento técnico (L3) para incidentes maiores envolvendo bases de dados distribuídas, plataformas de busca e sistemas de mensagens;
  • Servir como um Especialista em Assunto em bases de dados relacionais, tecnologias NoSQL, motores de busca distribuídos e plataformas de mensagens;
  • Liderar esforços complexos de solução de problemas e realizar análises profundas de causas raízes (RCA) para problemas recorrentes e interrupções de produção;
  • Colaborar com equipas de engenharia em eventos importantes de ciclo de vida, incluindo atualizações, migrações, planeamento de capacidade e iniciativas de modernização de plataformas;
  • Gerir a saúde, escalabilidade e otimização de clusters distribuídos, incluindo descomissionamento de nós, reequilíbrio e ajuste de desempenho;
  • Definir e otimizar indexação, sharding e estratégias de busca em ambientes Elasticsearch, OpenSearch e Solr;
  • Desenvolver e manter soluções de Infraestrutura como Código (IaC) utilizando Terraform e Ansible para padronizar implantações e procedimentos operacionais;
  • Apoiar e manter ambientes de big data em grande escala; Conduzir iniciativas de automação para reduzir a sobrecarga operacional e melhorar a confiabilidade da plataforma;
  • Participar de uma rotação de chamadas 24/7 e fornecer suporte durante intervenções planejadas nos fins de semana quando necessário.

Requisitos:

  • Mais de 7 anos de experiência prática na gestão de sistemas distribuídos em grande escala;
  • Experiência forte com:
  • Apache Kafka
  • Apache Cassandra
  • Elasticsearch
  • OpenSearch
  • Apache Solr
  • Experiência sólida com:
  • Redis
  • RabbitMQ
  • MapR / ecossistemas Hadoop
  • Administração de nível especialista em Linux/Unix;
  • Fortes competências em scripting de shell (Bash);
  • Experiência comprovada em construir soluções de automação com:
  • Terraform
  • Ansible
  • Experiência na gestão de escalabilidade de clusters, ajuste de desempenho, gestão de ciclo de vida de nós e resposta a incidentes;
  • Fortes habilidades de solução de problemas e analíticas em ambientes de produção complexos;
  • Capacidade de liderar investigações técnicas e coordenar a resolução de incidentes críticos;
  • Disponibilidade para participar de uma rotação de chamadas 24/7;
  • Flexibilidade para trabalhar em horários rotativos quando necessário.

Desejável:

  • Experiência com tecnologias de bases de dados relacionais como:
  • Oracle
  • PostgreSQL
  • MySQL
  • MariaDB
  • Experiência em apoiar ecossistemas de bases de dados e mensagens em grandes ambientes empresariais;
  • Conhecimento em práticas de padronização de infraestrutura e engenharia de plataformas;
  • Experiência em mentoria de equipas e condução de iniciativas de excelência operacional;
  • Disposição para expandir a especialização em múltiplas tecnologias dentro do ecossistema de plataforma.

Informação Importante:

  • Modelo de trabalho híbrido em Almada ou Aveiro;
  • Horário de trabalho alinhado com equipas internacionais (09:00–18:00 e/ou 14:00–23:00);
  • Participação em uma rotação de chamadas é obrigatória;
  • Intervenções nos fins de semana podem ser necessárias, compensadas através de horários flexíveis;
  • Os candidatos devem residir em Portugal.

Candidate-se a esta oportunidade no nosso site! =)

Contactos e Endereço