Coordenador(a) de NOC e Gestão de Crise
RPE
Detalhes da vaga
- Cargo
- Coordenador(a) de NOC e Gestão de Crise
- Vagas
- 1
- Modelo
- Presencial
- Publicada
- 26/08/2026
- Candidaturas até
- 25/09/2026
Localização
Descrição da vaga
A RPE é a fintech líder no varejo nacional, especializada em soluções completas de BaaS (Banking as a Service) e crédito digital. Nós não apenas processamos cartões; nós empoderamos o varejista com autonomia, segurança e inteligência de ponta a ponta.Nossa atuação transforma o crédito em um vetor estratégico de crescimento. Através do Private Label, permitimos que grandes marcas tenham controle total sobre sua operação financeira, fidelizando clientes e gerando rentabilidade. Com nossas soluções de CDC e BNPL (Buy Now, Pay Later), levamos poder de compra ao consumidor e resultados consistentes aos nossos parceiros, unindo conveniência e tecnologia. Se você é apaixonado por resolver problemas críticos, manter a estabilidade operacional e garantir que a operação nunca pare, essa oportunidade é para você! Estamos em busca de um(a) Coordenador(a) de NOC e Gestão de Crise para atuar em um ambiente de missão crítica, liderando time de NOC e assegurando a confiabilidade e escalabilidade dos nossos sistemas.Você será o elo central durante incidentes, orquestrando a equipe de resposta para garantir que todos os profissionais necessários sejam engajados rumo à resolução ágil. Além de atuar ativamente na gestão de crises de alta prioridade, você atuará na visão de disponibilidade das nossas plataformas, impactando diretamente a experiência dos nossos usuários e protegendo a continuidade dos negócios.
Responsabilidades e atribuiçõesGerenciar incidentes e crises, liderando a comunicação, coordenação e a tomada de decisões rápidas e assertivas sob pressão;Coordenar a equipe do NOC (Network Operations Center) prevenindo silos de comunicação e garantindo uma colaboração fluida durante incidentes críticos;Desenvolver e manter procedimentos padrão (playbooks/runbooks) de resposta a incidentes, além de organizar treinamentos e simulações para garantir que a equipe esteja preparada para diversos cenários de crise;Facilitar análises pós-incidentes (post-mortems), separando sintomas das verdadeiras causas-raiz, propondo melhorias e acompanhando a execução de planos de ação preventivos;Atuar como o elo central e traduzir informações altamente técnicas em atualizações claras de status para equipes de negócios, nível executivo (stakeholders) e demais áreas, alinhando as expectativas sobre o impacto e os prazos de recuperação;Garantir a eficiência operacional monitorando e otimizando indicadores essenciais como SLOs, SLAs, MTTR (Tempo Médio para Reparo) e MTTA (Tempo Médio para Reconhecimento); Trabalhar junto às áreas de Arquitetura e SRE (Site Reliability Engineering) para propor melhorias na resiliência dos sistemas, nos fluxos de resposta e na gestão de riscos operacionais a longo prazo.
Requisitos e qualificaçõesExperiência na liderança de equipes técnicas, gestão de times e coordenação de operações de TI em ambientes de alta criticidade ou plataformas SaaS; Conhecimento em ITSM e práticas ITIL (englobando o ciclo de vida completo de Gestão de Incidentes, Problemas e Mudanças); Experiência prática na utilização de alertas, logs, métricas e tracing (como Datadog, Elastix, Grafana, New Relic, Sentry, etc.) para validar impactos e acelerar decisões;Entendimento sólido de arquitetura de sistemas, ambientes em nuvem (como AWS) e boas práticas da cultura DevOps;Capacidade de gerenciamento de estresse e inteligência emocional para manter o foco e tomar decisões claras e estruturadas em situações de incerteza. Comunicação objetiva, empática e transparente.Informações adicionaisModelo de trabalho: 100% Presencial em João Pessoa. Modelo de contratação: Associado
Fonte: gupy