A RPE é a fintech líder no varejo nacional, especializada em soluções completas de BaaS (Banking as a Service) e crédito digital. Nós não apenas processamos cartões; nós empoderamos o varejista com autonomia, segurança e inteligência de ponta a ponta.
Nossa atuação transforma o crédito em um vetor estratégico de crescimento. Através do Private Label, permitimos que grandes marcas tenham controle total sobre sua operação financeira, fidelizando clientes e gerando rentabilidade. Com nossas soluções de CDC e BNPL (Buy Now, Pay Later), levamos poder de compra ao consumidor e resultados consistentes aos nossos parceiros, unindo conveniência e tecnologia.
Se você é apaixonado por resolver problemas críticos, manter a estabilidade operacional e garantir que a operação nunca pare, essa oportunidade é para você! Estamos em busca de um(a) Coordenador(a) de NOC e Gestão de Crise para atuar em um ambiente de missão crítica, liderando time de NOC e assegurando a confiabilidade e escalabilidade dos nossos sistemas.Você será o elo central durante incidentes, orquestrando a equipe de resposta para garantir que todos os profissionais necessários sejam engajados rumo à resolução ágil. Além de atuar ativamente na gestão de crises de alta prioridade, você atuará na visão de disponibilidade das nossas plataformas, impactando diretamente a experiência dos nossos usuários e protegendo a continuidade dos negócios.
- Gerenciar incidentes e crises, liderando a comunicação, coordenação e a tomada de decisões rápidas e assertivas sob pressão;
- Coordenar a equipe do NOC (Network Operations Center) prevenindo silos de comunicação e garantindo uma colaboração fluida durante incidentes críticos;
- Desenvolver e manter procedimentos padrão (playbooks/runbooks) de resposta a incidentes, além de organizar treinamentos e simulações para garantir que a equipe esteja preparada para diversos cenários de crise;
- Facilitar análises pós-incidentes (post-mortems), separando sintomas das verdadeiras causas-raiz, propondo melhorias e acompanhando a execução de planos de ação preventivos;
- Atuar como o elo central e traduzir informações altamente técnicas em atualizações claras de status para equipes de negócios, nível executivo (stakeholders) e demais áreas, alinhando as expectativas sobre o impacto e os prazos de recuperação;
- Garantir a eficiência operacional monitorando e otimizando indicadores essenciais como SLOs, SLAs, MTTR (Tempo Médio para Reparo) e MTTA (Tempo Médio para Reconhecimento);
- Trabalhar junto às áreas de Arquitetura e SRE (Site Reliability Engineering) para propor melhorias na resiliência dos sistemas, nos fluxos de resposta e na gestão de riscos operacionais a longo prazo.
- Experiência na liderança de equipes técnicas, gestão de times e coordenação de operações de TI em ambientes de alta criticidade ou plataformas SaaS;
- Conhecimento em ITSM e práticas ITIL (englobando o ciclo de vida completo de Gestão de Incidentes, Problemas e Mudanças);
- Experiência prática na utilização de alertas, logs, métricas e tracing (como Datadog, Elastix, Grafana, New Relic, Sentry, etc.) para validar impactos e acelerar decisões;
Entendimento sólido de arquitetura de sistemas, ambientes em nuvem (como AWS) e boas práticas da cultura DevOps; - Capacidade de gerenciamento de estresse e inteligência emocional para manter o foco e tomar decisões claras e estruturadas em situações de incerteza. Comunicação objetiva, empática e transparente.
Modelo de trabalho: 100% Presencial em João Pessoa.
Modelo de contratação: Associado