Sobre a Vaga
Disponibilidade para atuar em escala 12x36
Atuar na monitoração contínua de ambientes de cloud (infraestrutura, aplicações e serviços), garantindo a detecção proativa de falhas e indisponibilidades por meio de ferramentas como Zabbix, Grafana e outras soluções de observabilidade;
Contribuir com a estabilidade e disponibilidade dos serviços da Neogrid, realizando abertura, categorização e encaminhamento de incidentes de forma rápida, clara e precisa, seguindo os fluxos definidos;
Desenvolver análises iniciais de eventos e alarmes, buscando correlações entre métricas e logs que possam ajudar no diagnóstico de falhas em ambientes críticos;
Acompanhar chamados técnicos até a sua resolução, atuando junto a times de N2/N3 e garantindo que os devidos registros estejam completos, com comunicação assertiva e atualizações frequentes;
Orientar os usuários ou áreas técnicas durante escalonamentos, fornecendo as informações relevantes do incidente, histórico do alarme e ações já executadas, com postura técnica e colaborativa;
Resolver prontamente os eventos de baixa e média complexidade, sempre que estiverem dentro da base de conhecimento e processos operacionais disponíveis, documentando cada ação;
Ajudar na melhoria contínua da base de conhecimento técnico (procedimentos, scripts, fluxos de atendimento), sugerindo ajustes com base nas ocorrências do plantão e recorrências identificadas;
Auxiliar na validação de novas implementações de monitoramento (hosts, templates, triggers) e no processo de onboarding de novas aplicações/sistemas no Zabbix, em parceria com SRE/CloudOps.
Requisitos
- Experiência com Zabbix (obrigatório) e desejável conhecimento em outras ferramentas como Prometheus ou Grafana;
- Noções de observabilidade, análise de métricas, logs e comportamento de aplicações;
- Conhecimento básico de cloud computing (Huawei, Azure ou GCP);
- Experiência com sistemas operacionais Linux e Windows Server;
- Habilidade com abertura e atendimento de chamados em ferramentas como Jira, OTRS, GLPI, etc;
- Capacidade de compreender e agir sobre triggers, thresholds e dashboards;
- Conhecimentos básicos em redes, infraestrutura e conectividade;
Benefícios
- Plano de saúde
- Plano odontológico
- Seguro de vida
- Vale transporte
- Vale alimentação
- TotalPass
- Day Off
Vagas semelhantes para você
Selecionadas com base na tecnologia, modalidade, nível e localização desta oportunidade.