Especialista Devops
Stefanini Group
Detalhes da vaga
- Cargo
- Especialista Devops
- Vagas
- 1
- Modelo
- Remoto
- Publicada
- 13/08/2026
- Candidaturas até
- 05/04/2027
Descrição da vaga
No Grupo Stefanini, acreditamos no poder da colaboração. Co-criamos soluções inovadoras em parceria com nossos clientes, combinando tecnologia de ponta, inteligência artificial e a criatividade humana. Estamos na vanguarda da resolução de problemas de negócios, proporcionando impacto real em escala global.
Ao se juntar à Stefanini, você se torna parte de uma jornada global de transformação. Estamos empenhados em criar impacto positivo não apenas nos negócios, mas também na vida de nossos colaboradores. Se você procura uma oportunidade de crescimento profissional em uma empresa que valoriza inovação, respeito, autonomia e parceria, você encontra aqui!
Junte-se a nós e seja parte da mudança!
#LIREMOTE#LI-SS1 Responsabilidades e atribuições
Estamos em busca de uma Pessoa Engenheira SRE com foco em Observabilidade para atuar em ambientes críticos, garantindo alta disponibilidade, performance e confiabilidade de aplicações de missão crítica.
Você será uma das principais referências técnicas em observabilidade, trabalhando na evolução da estratégia de monitoramento, análise de incidentes e automação operacional, além de apoiar os times de engenharia na construção de uma cultura de excelência operacional e confiabilidade.
Principais responsabilidades
Projetar, implementar e evoluir a estratégia de observabilidade utilizando Datadog e ELK Stack (Elasticsearch + Kibana);Estruturar e correlacionar métricas, logs e traces para troubleshooting e análise de causa raiz
Definir e evoluir SLIs, SLOs, Error Budgets, dashboards e alertas inteligentes, reduzindo ruídos e acelerando a resolução de incidentes
Atuar tecnicamente em incidentes críticos, conduzindo análises de causa raiz e propondo ações preventivas para evitar recorrências
Apoiar squads de desenvolvimento na adoção das melhores práticas de SRE, DevOps, observabilidade e confiabilidade
Automatizar atividades operacionais e processos utilizando Python
Contribuir para a evolução contínua da plataforma, promovendo maior estabilidade, escalabilidade e eficiência operacional.
Requisitos e qualificações
Requisitos obrigatórios
Experiência sólida em Site Reliability Engineering (SRE) ou áreas correlatas
Forte experiência com Datadog
Experiência em análise de logs utilizando ELK Stack (Elasticsearch e Kibana);Vivência com correlação entre métricas, logs e traces para identificação de causa raiz
Experiência em ambientes de missão crítica, alta disponibilidade e alto volume transacional
Conhecimento de práticas de observabilidade e monitoramento de aplicações.
Conhecimentos desejáveis
Cloud Computing, preferencialmente AWS;Kubernetes
Pipelines de CI/CD;Infraestrutura como Código (Terraform);Automação utilizando Python
Conhecimento de aplicações Java em runtime e troubleshooting.
Será considerado um diferencial
Experiência com definição de SLIs, SLOs, Error Budgets e cultura SRE;Experiência em ambientes Multi-Cloud
Automação avançada de operações
Conhecimento em Inteligência Artificial aplicada à observabilidade e operações (AIOps).
Informações adicionais🍛 Vale-alimentação ou vale-refeição;👨🏼🎓 Desconto em cursos, universidades e instituições de idiomas;📚 Academia Stefanini — plataforma com cursos on-line, gratuitos, atualizados e com certificado;🗣 Mentoring;💉 Clube de vantagens para consultas e exames;🏥 Assistência médica;🦷 Assistência odontológica;💰 Clube de vantagens e descontos nos melhores estabelecimentos;🛫 Clube de viagens;🐶 Convênio para pets.
Fonte: gupy