Analista de Infraestrutura de TI - Observabilidade
Unifique
Detalhes da vaga
- Cargo
- Analista de Infraestrutura de TI - Observabilidade
- Vagas
- 1
- Modelo
- Remoto
- Publicada
- 14/08/2026
- Candidaturas até
- 04/10/2026
Descrição da vaga
Nosso time de TI é responsável pela sustentação e evolução de diversos serviços essenciais para a empresa, como sistemas operacionais, virtualização, serviços de autenticação, bancos de dados, monitoramento, redes e segurança da informação, atendendo tanto ambientes internos quanto ambientes de clientes.
A vaga de Analista de Observabilidade Sênior tem como principal objetivo atuar na evolução da estratégia de observabilidade da organização, garantindo visibilidade, disponibilidade e desempenho dos serviços por meio da implementação, administração e evolução das plataformas de monitoramento, métricas, logs, traces e dashboards.
Buscamos profissionais comprometidos, organizados e com perfil proativo, que gostem de resolver problemas, trabalhar em equipe e atuar em ambientes críticos, contribuindo para a melhoria contínua da infraestrutura.
Temos vaga para facilitar a vida das pessoas junto desse time. Ficou interessado? Envie seu currículo!
Esta e as demais vagas anunciadas estão disponíveis para PcD ♿
Responsabilidades e atribuições
- Administrar, sustentar e evoluir as plataformas de observabilidade da organização.
- Desenvolver e implementar estratégias de monitoramento para infraestrutura, aplicações, bancos de dados, redes, containers e serviços em nuvem.
- Administrar ambientes Zabbix, Grafana, Instana e demais ferramentas de observabilidade.
- Criar e manter templates, dashboards, mapas, alertas, indicadores e painéis executivos.
- Definir métricas, KPIs, SLIs e SLOs para acompanhamento da disponibilidade e desempenho dos serviços.
- Desenvolver integrações entre plataformas de observabilidade, sistemas corporativos e ferramentas de ITSM utilizando APIs e Webhooks.
- Desenvolver automações para provisionamento, coleta de métricas, geração de alertas e redução de atividades operacionais repetitivas.
- Atuar na análise de causa raiz (RCA) de incidentes relacionados à infraestrutura e aplicações.
- Apoiar equipes de Infraestrutura, Banco de Dados, Desenvolvimento, DevOps e Segurança na identificação e resolução de problemas.
- Administrar e realizar manutenção dos bancos de dados utilizados pelas plataformas de observabilidade, garantindo seu desempenho, disponibilidade e integridade.
- Participar da implantação de novos serviços garantindo aderência às boas práticas de observabilidade.
- Elaborar documentação técnica e disseminar boas práticas para as equipes.
- Participar de escalas de sobreaviso quando necessário.
Experiência esperada
- Experiência sólida com plataformas corporativas de observabilidade.
- Vivência em ambientes críticos e de alta disponibilidade.
- Experiência na construção de dashboards operacionais e executivos.
- Experiência em análise de métricas, logs, traces e indicadores de desempenho.
- Vivência em troubleshooting de infraestrutura, aplicações e serviços.
- Experiência no desenvolvimento de automações utilizando scripts e APIs.
- Experiência com ambientes Linux.
- Vivência com containers e orquestração será considerada diferencial.
- Experiência em ambientes híbridos (on-premises e cloud) será considerada diferencial.
Requisitos técnicos
- Administração avançada de Zabbix.
- Administração avançada de Grafana.
- Experiência com Instana para observabilidade de aplicações e infraestrutura.
- Conhecimento em plataformas de gerenciamento de logs, como OpenSearch, Elasticsearch, Graylog ou similares.
- Conhecimento em conceitos de observabilidade, incluindo métricas, logs, traces, SLIs, SLOs e KPIs.
- Desenvolvimento de dashboards executivos e operacionais.
- Administração e manutenção dos bancos de dados utilizados pelas plataformas de observabilidade (PostgreSQL, MySQL/MariaDB ou equivalentes).
- Conhecimento em Linux para administração das plataformas.
- Conhecimento em redes (TCP/IP, DNS, HTTP/HTTPS, SNMP, ICMP e TLS).
- Experiência com Docker, incluindo implantação, administração e troubleshooting de containers.
- Conhecimento em APIs REST e Webhooks para integração entre ferramentas.
- Conhecimento em automação utilizando Shell Script, Python ou PowerShell.
- Capacidade de desenvolver scripts e automações para provisionamento, coleta de métricas, geração de alertas e integração entre plataformas.
- Conhecimento em Git será considerado diferencial.
- Conhecimento em Kubernetes será considerado diferencial.
- Conhecimento em Prometheus, Alertmanager e VictoriaMetrics será considerado diferencial.
- Conhecimento em OpenTelemetry será considerado diferencial.
Habilidades comportamentais
- Perfil analítico e visão sistêmica.
- Excelente capacidade de troubleshooting.
- Boa comunicação técnica e interpessoal.
- Organização e documentação.
- Trabalho em equipe e colaboração.
- Proatividade e senso de responsabilidade.
- Facilidade para aprendizado contínuo.
- Capacidade de liderar iniciativas técnicas e propor melhorias.
Formação e cursos
- Ensino superior completo em Ciência da Computação, Sistemas de Informação, Engenharia da Computação, Redes de Computadores ou áreas correlatas.
- Cursos voltados para Observabilidade, Zabbix, Grafana, Instana, Linux, Docker, Kubernetes, Automação ou Cloud serão considerados diferenciais.
Certificações desejáveis
- Zabbix Certified Specialist (ZCS).
- Zabbix Certified Professional (ZCP).
- Grafana Certified Associate.
- IBM Instana Technical Sales Intermediate ou certificações equivalentes da plataforma Instana (desejável).
- CKA – Certified Kubernetes Administrator (diferencial).
- LFCS – Linux Foundation Certified System Administrator (diferencial).
- ITIL Foundation.
- Atuar junto ao time de monitoramento e suporte a clientes.
- Acompanhar consoles de monitoramento.
- Tratar eventos de alertas.
- Alteração de recursos de hardware em servidores Virtuais.
- Notificar ações realizadas para equipe.
- Acompanhar grupo de Comunicação da equipe.
- Acionamento de equipes de apoio.
- Atendimento de Ligações Telefônicas.
Horário de trabalho: Segunda a sexta-feira das 08h às 12h e das 13h12 às 18h.
Oportunidade para trabalhar remoto.
Fonte: gupy