Technical Lead – IT Monitoring & Observability
Timestamp SI
A Timestamp SI procura talentos que queiram fazer parte de uma equipa dinâmica que tem a ambição de desafiar a inovação e as melhores e mais recentes metodologias e tecnologias. Responsabilidades: - Gerir e coordenar as atividades do Centro de Controlo e Monitorização. - Definir e implementar estratégias de monitorização e observabilidade para aplicações, serviços e infraestruturas. - Assegurar que todas as aplicações e componentes de infraestrutura estão integrados no CCO e cobertos por mecanismos adequados de monitorização. - Definir métricas, indicadores, dashboards e alertas operacionais, garantindo a sua relevância e eficácia. - Promover a automação e o scripting de tarefas operacionais e processos de monitorização. - Acompanhar eventos, incidentes e problemas, assegurando a sua análise, encaminhamento e resolução atempada. - Garantir o cumprimento dos níveis de serviço acordados e dos processos de gestão de incidentes e eventos. - Apoiar a definição e evolução de processos operacionais alinhados com as boas práticas ITIL. - Trabalhar com equipas de desenvolvimento, infraestrutura e operações na identificação de riscos e melhoria contínua da fiabilidade dos serviços. - Produzir documentação técnica e operacional, reportando indicadores de desempenho, disponibilidade e qualidade da monitorização. Perfil pretendido: - Formação superior em Engenharia Informática, Engenharia de Software ou área similar. - Capacidade para trabalhar com equipas técnicas e de negócio, traduzindo necessidades operacionais em soluções de monitorização. - Boa capacidade de comunicação escrita e verbal. - Experiência na liderança técnica e/ou gestão de centros de controlo, operação e monitorização. - Experiência na implementação de soluções de monitorização e observabilidade de serviços tecnológicos. - Conhecimentos de automação e scripting para operações de TI. - Experiência na configuração de dashboards, métricas, indicadores e alertas operacionais. - Conhecimentos de gestão de incidentes, eventos, problemas e níveis de serviço. - Conhecimentos de metodologias e boas práticas ITIL. - Experiência na análise de disponibilidade, desempenho e capacidade de aplicações e infraestruturas. Conhecimentos valorizados: - Experiência com ferramentas de monitorização, observabilidade, gestão de eventos e alertas. - Conhecimentos de ambientes cloud, infraestruturas, redes, sistemas operativos e bases de dados. - Experiência com ferramentas de automação e scripting, nomeadamente Python, PowerShell ou Bash. - Conhecimentos de conceitos de logging, tracing, métricas, APM e monitorização de APIs. - Experiência em ambientes de produção críticos e com requisitos elevados de disponibilidade. - Experiência na definição e acompanhamento de SLAs, OLAs e KPIs operacionais.
- Publicado
- 10 de agosto de 2026
A carregar obras relevantes...