Profissional para Monitoreamento de Ambientes Distribuídos
A empresa está à procura de um profissional experiente em monitoramento de ambientes distribuídos e confiabilidade. O candidato ideal terá experiência sólida em engenharia de confiabilidade, monitoramento de sistemas distribuídos e gestão de incidentes críticos.
Responsabilidades:
* Liderar a implementação e evolução da plataforma de observabilidade;
* Definir, padronizar e manter painéis e alertas para serviços críticos da organização;
* Estabelecer e acompanhar indicadores de confiabilidade (SLIs, SLOs), orientando decisões técnicas com base em dados;
* Automatizar respostas a alertas e reduzir o toil por meio de scripts e integrações entre ferramentas;
* Atuar na gestão de incidentes: triagem, coordenação de resolução, documentação e melhoria contínua;
Se você tem experiência em observabilidade ponta a ponta com Zabbix, Elastic Stack e Dynatrace, e conhecimento em práticas modernas de observabilidade, rastreamento distribuído e automação de alertas, este é seu lugar!
Requisitos:
* Experiência sólida como SRE, Observability Engineer ou DevOps com foco em monitoramento;
* Domínio técnico de Zabbix, Elastic Stack e Dynatrace em ambientes de missão crítica;
* Forte entendimento de arquitetura de sistemas distribuídos e métricas operacionais;
* Vivência com rastreamento distribuído e integração de logs/métricas em pipelines CI/CD;
* Capacidade de correlacionar dados de observabilidade com impacto no negócio;
A empresa oferece uma oportunidade desafiadora e recompensadora para alguém que busque crescimento e inovação.
Informações adicionais:
Contrato: Pessoa Jurídica (PJ); Modelo de atuação: 100% Remoto.