A página completa do módulo

Incidentes & Continuidade: quem está no comando quando a formatura sai do roteiro

Radar com o que está aberto em sete módulos da plataforma numa lista só, incidente coordenado com severidade de SEV1 a SEV4, comandante, boletins com prazo e aviso no sino quando o SLA estoura, quem está de plantão agora, custo do incidente, MTTA e MTTR calculados pelos marcos, processos críticos com RTO, RPO e fornecedores críticos, planos de contingência a partir de modelos, acionamento passo a passo, comunicados de crise, pós-mortem sem culpado, ações de todos os módulos numa lista só, exercícios, prontidão dos próximos eventos com decisão go/no-go registrada e previsão do tempo, kit de crise para imprimir, análise de tendência e nota de maturidade.

Esta é a referência inteira do módulo em uma página só: as treze telas do painel, a régua de severidade, a biblioteca de processos, planos e comunicados, as frentes funcionais com cada recurso listado um a um, as decisões de projeto que explicam por que o sistema recusa certas coisas, as fronteiras com os outros módulos e o glossário dos termos de resposta a incidente.

  • 13telas no painel, do radar à nota de maturidade
  • 7módulos lidos pelo radar, sem copiar nenhum registro
  • 12processos críticos com RTO e RPO já sugeridos
  • 12modelos de plano de contingência, do gateway à chuva
  • 4níveis de severidade com critério escrito e SLA

O módulo por dentro

As 13 telas, na ordem em que o trabalho acontece

Quatro blocos no menu do painel. A resposta cuida do que está acontecendo agora, a continuidade prepara a empresa para o que pode acontecer, o aprendizado garante que o mesmo problema não volte e a configuração ajusta prazos e travas ao ritmo da empresa.

01

Resposta

O que está pegando fogo agora, quem está no comando e o que já foi feito.

3 telas
  • PainelIncidentes em aberto por severidade, boletim atrasado em relação ao SLA, incidente grave sem comandante, quem está de plantão agora, custo dos incidentes nos últimos 90 dias, MTTA e MTTR, o que o radar tem de grave sem incidente e a cobertura de planos dos processos críticos.
  • RadarAs ocorrências abertas da Produção de Eventos, do Compliance, do SST, da Equipe de campo, do Suporte, da Qualidade e as falhas recentes da rotina de pagamento bancário numa lista só, com gravidade normalizada e o botão de promover a incidente.
  • IncidentesA lista e a sala do incidente: triagem, severidade, comandante e envolvidos, plantão do momento, marcos de tempo, boletins internos e externos, plano acionado, comunicados, custos e linha do tempo completa. Incidente de dado pessoal abre o registro de privacidade no Compliance.
02

Continuidade

Quais processos param a empresa, em quanto tempo precisam voltar e o que fazer quando param.

6 telas
  • Processos críticosA análise de impacto pronta: doze processos com RTO, RPO, impacto, dono, dependências lidas da plataforma, fornecedores críticos com substituto e situação da due diligence, plano vinculado e último teste. A lista vem filtrada pelos módulos que a empresa usa.
  • Planos de contingênciaModelos prontos para aplicar e editar, editor de passos por fase com responsável e prazo, versão, revisão e situação do plano.
  • ExercíciosTeste de mesa, simulado e teste técnico de um plano, com cenário, participantes, resultado e as lacunas encontradas.
  • Prontidão dos eventosOs próximos eventos com a checagem feita na hora: escala com vaga descoberta, licença que vence antes da data, problema aberto, incidente ligado e plano do evento testado. Previsão do tempo sob demanda e a decisão go/no-go gravada com o retrato das checagens.
  • Plantão & ContatosEscala de plantão com primário e secundário, os buracos da escala nos próximos 30 dias e os contatos de emergência: órgão público, seguradora, fornecedor e interno, por processo ou por evento.
  • Kit de CrisePor processo, plano ou evento, uma página para imprimir com o plano vigente e os passos, quem chamar, o plantão, os modelos de comunicado e as checagens do evento. Para o salão sem internet.
03

Aprendizado

O que a empresa aprendeu com o incidente, a prova de que o plano funciona e o quanto a resposta está melhorando.

3 telas
  • Pós-mortem & açõesPós-mortem por incidente com rascunho montado do próprio registro, cinco porquês, fatores contribuintes e ações com dono e prazo. Uma aba junta as ações da Continuidade, do Compliance e da Qualidade numa lista só.
  • Análise de IncidentesMTTA e MTTR por mês, percentual de SLA cumprido, recorrência por categoria, origem, evento e fornecedor e o mapa de dia da semana e hora.
  • MaturidadeNota de 0 a 100 em sete pilares de continuidade de negócios, calculada sobre o que está registrado, com os próximos passos que mais sobem a nota.
04

Configuração

Os prazos e travas que a empresa ajusta, sem reescrever a regra.

1 tela
  • ConfiguraçãoSLAs de reconhecimento, boletim e resolução por severidade, trava de pós-mortem obrigatório para SEV1 e SEV2, canal e contato de plantão.

O problema e a saída

O que muda no dia a dia de quem responde quando algo dá errado

A dor

O problema do salão ficou na Produção de Eventos, o acidente no SST, o fotógrafo que faltou na Equipe e o chamado urgente no Suporte. Ninguém via os quatro ao mesmo tempo.

Com o Partiu Formatura

O radar lê esses registros na hora e mostra tudo que está aberto numa lista só, com a gravidade normalizada. Nada é copiado: cada registro continua no módulo dono dele.

A dor

O incidente SEV1 começou às 22h de um sábado de formatura, e o painel com o boletim em vermelho não tinha ninguém olhando.

Com o Partiu Formatura

A cada dez minutos o sistema confere os SEV1 e SEV2 abertos. Reconhecimento ou boletim atrasado vira aviso no sino para os administradores e para o comandante, uma vez por estouro, gravado na própria linha do tempo.

A dor

O plano dizia "acione o responsável de plantão", e ninguém sabia quem era naquela semana nem o telefone do gerador reserva.

Com o Partiu Formatura

A escala de plantão mostra o primário e o secundário de agora no painel e na sala do incidente, e os contatos de emergência ficam por processo e por evento, com os buracos da escala avisados antes de acontecer.

A dor

O baile externo aconteceu com 80% de chance de chuva, e depois ninguém lembrava quem tinha decidido manter nem com base em quê.

Com o Partiu Formatura

A prontidão mostra a previsão do tempo do evento e aponta o plano de chuva. A decisão go, go com ressalva ou no-go fica gravada com o responsável, a justificativa e o retrato das checagens recalculado no servidor naquele momento.

A dor

A diretoria perguntou quanto os incidentes do semestre custaram, e a resposta foi um chute.

Com o Partiu Formatura

Cada incidente registra reembolso, multa, hora extra, fornecedor substituto e receita perdida. O total aparece na sala, e o painel soma os últimos noventa dias.

A dor

O buffet faltou e a equipe descobriu na hora que não havia substituto cadastrado, e que o fornecedor tinha sido reprovado na due diligence.

Com o Partiu Formatura

Cada processo crítico lista os fornecedores que o sustentam, o substituto de cada um e a situação da due diligence lida do Compliance na hora.

A dor

Cada pessoa achava que outra estava cuidando, e o incidente ficou uma hora sem ninguém no comando.

Com o Partiu Formatura

O incidente tem um comandante só, e o painel destaca incidente SEV1 ou SEV2 sem comandante. Os papéis de comunicação, técnico, operação, fornecedor e observador ficam registrados na sala.

A dor

A comissão ligou três vezes pedindo notícia, e a última atualização tinha sido de manhã.

Com o Partiu Formatura

Cada severidade tem prazo de boletim: a cada 30 minutos no SEV1, a cada 2 horas no SEV2. O atraso é calculado no banco, no mesmo relógio dos marcos, e aparece em vermelho no painel.

A dor

O incidente grave foi classificado como pequeno para não chamar atenção.

Com o Partiu Formatura

A triagem sugere a severidade pelas respostas: risco à vida, dado pessoal, evento parado, dinheiro comprometido, contorno manual. Subir não exige nada; registrar abaixo do sugerido exige motivo, e todo rebaixamento vai para a linha do tempo.

A dor

O plano de contingência existia num PDF que ninguém abriu no dia em que o gateway caiu.

Com o Partiu Formatura

O plano é acionado dentro do incidente e vira checklist passo a passo, com fase, responsável e prazo. Passo marcado como não se aplica exige o motivo escrito.

A dor

Ninguém sabia dizer quanto tempo a cobrança podia ficar parada, nem do que ela dependia.

Com o Partiu Formatura

Os processos críticos já vêm com RTO e RPO sugeridos para uma empresa de formatura, e as dependências são lidas da configuração: gateway habilitado, WhatsApp conectado, armazenamento, escala e licenças.

A dor

O mesmo problema voltou no evento seguinte, porque a reunião depois do incidente virou procura de culpado.

Com o Partiu Formatura

O pós-mortem só publica com resumo, o que falhou, ao menos um porquê e uma causa raiz em forma de frase. Um nome de pessoa sozinho não passa. SEV1 só encerra com pós-mortem publicado.

A dor

Na véspera da formatura, a equipe descobriu que faltavam dois profissionais na escala e que o alvará vencia um dia antes.

Com o Partiu Formatura

A prontidão confere cada evento dos próximos dias contra a escala, as licenças, os problemas abertos, os incidentes e o plano do evento, e ordena do crítico para o que está em dia.

A dor

A mensagem para os formandos saiu com a previsão errada e com um campo do modelo sem preencher.

Com o Partiu Formatura

O comunicado é redigido a partir do modelo com os dados do incidente. O marcador que o sistema não sabe preencher continua visível, e o registro recusa texto com marcador sobrando.

Como funciona

O caminho de um incidente, da primeira ocorrência à ação que evita a próxima

  1. 1

    A ocorrência aparece

    Alguém registra o problema no módulo de sempre: a Produção de Eventos, o SST, a Equipe, o Suporte. O radar mostra a ocorrência aberta junto das outras, sem que ninguém precise copiá-la.

  2. 2

    Vira incidente coordenado

    A ocorrência é promovida, e o incidente guarda só a referência à origem. A triagem sugere a severidade, o código INC-AAAA-NNNN é gerado no servidor e o marco de detecção é gravado.

  3. 3

    O comando assume

    O comandante é definido, os envolvidos recebem papel, o plano de contingência do processo afetado é acionado e os passos viram checklist dentro da sala.

  4. 4

    A informação circula no prazo

    Boletins internos e externos são publicados dentro do SLA da severidade, e os comunicados para formandos, comissão, equipe ou fornecedores saem de modelos preenchidos com os dados do incidente.

  5. 5

    Os marcos contam o tempo

    Reconhecido, contido, resolvido e encerrado, cada um gravado com o relógio do banco. Deles saem o MTTA, o MTTR e o atraso de cada boletim.

  6. 6

    O aprendizado fecha o ciclo

    O pós-mortem sem culpado registra causa raiz e fatores, as ações corretivas ganham dono e prazo, e o exercício seguinte prova que o plano ajustado funciona.

Como o sistema se comporta

17 decisões que explicam o resto

São elas que respondem por que o sistema às vezes não faz o que se espera dele, e por que isso é intencional.

O radar lê, não copia

Existem pelo menos sete módulos onde a plataforma registra problema, cada um com o dono certo. Copiar tudo para uma tabela nova criaria uma segunda versão que diverge na primeira atualização. O radar consulta cada fonte na hora e o incidente guarda só a referência.

O módulo abre com dado na tela

Processos críticos, modelos de plano e comunicados vêm prontos no código, e as dependências são lidas da configuração que a empresa já tem. Módulo que exige cadastro antes de mostrar a primeira linha fica vazio para sempre.

Severidade é regra, não opinião

O critério de cada nível está escrito e a triagem sugere o nível pelas respostas. Subir é livre. Descer exige motivo e fica na linha do tempo, porque o incidente rebaixado para não chamar atenção é exatamente o que mais precisa de atenção.

O relógio é o do banco

Os marcos do incidente são gravados com a hora do servidor de banco, e o atraso de SLA é calculado no mesmo lugar. Hora vinda do navegador depende do relógio de cada aparelho, e aí o MTTR mede o celular de quem clicou.

Um comandante só

Dois comandantes é o mesmo que nenhum: cada um espera o outro decidir. O servidor recusa nomear mais de um, e os outros papéis existem para dividir o trabalho sem dividir o comando.

O acionamento copia os passos

O plano pode ser melhorado no dia seguinte, mas o pós-mortem precisa ler o plano como ele era na hora do incidente. Por isso os passos são copiados no acionamento e a edição posterior não reescreve o que foi executado.

Pessoa não é causa raiz

Um nome sozinho no campo de causa raiz é onde a investigação começa, não onde termina. O pós-mortem só publica com a causa em forma de frase e com o que falhou, porque culpar alguém não impede o mesmo problema de voltar com outra pessoa.

O comunicado não inventa valor

O marcador que o incidente não sabe preencher continua visível no texto, e o registro recusa mensagem com marcador sobrando. Uma previsão inventada numa mensagem para formandos custa mais que um campo em branco que alguém percebe antes de enviar.

O módulo não dispara mensagem

O comunicado é redigido, revisado, enviado pelo canal de sempre e registrado aqui. Disparo automático entra quando houver envio avulso com auditoria reaproveitável, e até lá o registro diz quem mandou o quê, para quem e quando.

Desconhecido é uma resposta honesta

Quando falta dado para avaliar uma dependência ou um item da prontidão, a situação aparece como desconhecida, e não como ok. A tela que finge que está tudo bem é a que deixa o evento cair.

Configurar é ajustar, não reescrever

A empresa grava só o que mudou em relação ao padrão de SLA e de processo. Se a regra padrão melhorar numa atualização, quem não mexeu recebe a melhoria, e quem mexeu continua com o próprio valor.

Plano sem teste é suposição

O exercício realizado exige resultado, e resultado diferente de aprovado exige as lacunas escritas. A prontidão dos eventos considera se o plano do evento foi testado nos últimos doze meses, e não só se ele existe.

Aviso uma vez, e de novo só se atrasar de novo

O mesmo aviso repetido a cada dez minutos ensina a silenciar o sino. Cada estouro é avisado uma vez, e o boletim novo abre uma janela nova: quem atrasa outra vez é avisado outra vez. O controle fica na linha do tempo do incidente, onde o histórico mostra quando o aviso saiu.

A decisão guarda o que se sabia na hora

Depois do evento, a discussão é sempre sobre o que dava para saber antes. Por isso as checagens da decisão go/no-go são recalculadas no servidor no momento em que ela é gravada e ficam congeladas, sem aceitar a versão que veio da tela.

Previsão do tempo só quando alguém pede

A lista da prontidão não pode depender de um serviço externo para abrir. A previsão é consultada evento a evento, só para os próximos sete dias, com cache e tempo limite, e a cidade usada aparece para quem lê conferir.

Plano de crise precisa funcionar sem internet

O incidente mais grave de um evento costuma acontecer num salão com sinal ruim. O kit de crise junta plano, contatos, plantão e comunicados numa página feita para imprimir antes, e não para abrir durante.

Situação de fornecedor é lida, não copiada

A due diligence do fornecedor crítico continua no Compliance e é lida na hora. Uma cópia aqui ficaria aprovada para sempre, mesmo depois de o fornecedor entrar numa lista de sanção.

As fronteiras

Onde a resposta a incidente termina e o resto do sistema começa

O módulo não guarda uma segunda cópia de nada. Ele lê o que já existe e devolve o que produziu pelo mesmo caminho do resto da plataforma.

Sala de Operação do Evento

O problema do dia do evento continua sendo registrado na Produção de Eventos. O radar mostra o que está aberto lá, e a prontidão cruza problema aberto com o evento antes que ele comece.

Compliance Control

Incidente de integridade continua no Compliance, com investigação e remediação. O radar lê esses incidentes e os alertas graves do monitoramento, a ação do pós-mortem pode apontar para a ação de lá, e o incidente de dado pessoal abre o registro de privacidade onde corre o prazo de 3 dias úteis da ANPD. A due diligence dos fornecedores críticos também vem de lá.

Financeiro

A falha da rotina de pagamento bancário aparece no radar enquanto é recente, e o processo de cobrança dos formandos continua com o gateway de pagamento como dependência lida da configuração.

Segurança e Saúde no Trabalho

Acidente e quase acidente continuam no SST, dono da CAT. O radar mostra só o começo da descrição, e o detalhe fica sob a permissão do SST.

Qualidade e Conformidade

Não conformidade e reclamação continuam na Qualidade. Aparecem no radar enquanto abertas, e a ação corretiva do pós-mortem pode referenciar a ação do sistema de qualidade.

Eventos e Ingressos

A prontidão lê os próximos eventos, a escala da equipe de campo e as licenças ligadas a cada um. O incidente pode ser ligado ao evento e à turma afetados.

Comunicação

O comunicado de crise é redigido aqui e enviado pelos canais de sempre. O registro do envio fica no incidente e conta como boletim para o prazo da severidade.

Governança

Quem enxerga o quê, e o que roda sem ninguém pedir

4 permissões separadas

Checadas na tela e também na API. Nada no módulo é sensível por natureza, e por isso ele não usa permissão estrita; o detalhe de cada ocorrência continua sob a permissão do módulo de origem.

  • ConsultarPainel, radar, lista de incidentes, processos críticos e planos, só para leitura.
  • IncidentesAbrir incidente, promover do radar, publicar boletim, mudar severidade, marcar os marcos, lançar custos, registrar a decisão go/no-go e encerrar.
  • PlanosAjustar processos críticos e seus fornecedores, aplicar modelos, editar planos de contingência, registrar exercícios e manter o plantão e os contatos de emergência.
  • ConfiguraçãoSLAs por severidade, travas de pós-mortem e canal de plantão.

O que é calculado sem ninguém pedir

Não há cadastro para manter em dia. Cada tela abre calculando na hora, a partir do que a plataforma já registra, e uma única rotina agendada cuida de avisar o SLA estourado de quem não está olhando.

  • Leitura do radarAs fontes de ocorrência são consultadas a cada abertura, com a estrutura do banco conferida antes, e uma fonte fora do ar não derruba as outras.
  • Severidade sugeridaAs respostas da triagem viram um nível de severidade pelo critério do código, guardado junto do nível escolhido.
  • Atraso de boletimO tempo desde o último boletim é comparado ao SLA da severidade no SQL, e o incidente atrasado sobe no painel.
  • MTTA e MTTRMédias de detecção até reconhecimento e até resolução, por severidade, nos últimos noventa dias.
  • Dependências dos processosGateway, WhatsApp, armazenamento, escala, licenças e integrações lidos da configuração a cada abertura da tela.
  • Prontidão dos eventosCada evento da janela escolhida é conferido contra escala, licenças, problemas, incidentes e plano testado, e recebe a pior situação encontrada.
  • Rascunho do pós-mortemLinha do tempo e dados do incidente preenchem o rascunho quando o pós-mortem é aberto.
  • Aviso de SLA estouradoA cada dez minutos, SEV1 e SEV2 com reconhecimento ou boletim atrasado geram aviso no sino, uma vez por estouro.
  • Plantão do momentoQuem é o primário e o secundário agora, e onde a escala dos próximos 30 dias está descoberta.
  • Nota de maturidadeOs sete pilares recalculados a cada abertura, sobre planos, exercícios, incidentes, pós-mortem, plantão e prontidão.
  • Tendência e recorrênciaMTTA, MTTR, SLA cumprido e repetição por categoria, origem, evento e fornecedor agregados na hora.
  • Custo dos incidentesSoma dos custos lançados nos últimos noventa dias, no painel.

Na prática

5 situações do dia a dia, do problema ao resultado

01

O fotógrafo que não apareceu na colação

O cenário

Faltando uma hora para a cerimônia, o fotógrafo principal não fez check-in. A coordenação soube pelo grupo de mensagens, e três pessoas começaram a ligar para reservas diferentes ao mesmo tempo.

Com o sistema

A ocorrência da equipe apareceu no radar e foi promovida a incidente SEV1, porque o evento era nas próximas horas. O comandante foi nomeado, o plano de falta de equipe foi acionado e os passos de ligar para o profissional, acionar o reserva e redistribuir a cobertura viraram checklist com prazo.

O resultado

Um reserva chegou antes da entrada da turma, a comissão recebeu aviso pelo modelo e o pós-mortem apontou a lista de reservas desatualizada como causa, com ação para revisar a lista antes de cada evento.

02

O gateway que parou no dia do vencimento

O cenário

No dia de maior volume de boletos do mês, o PIX deixou de gerar. O financeiro percebeu pelas reclamações e ninguém sabia se devia suspender as cobranças automáticas.

Com o sistema

O incidente foi aberto como SEV1, porque a cobrança estava fora do ar sem contorno. O plano do gateway indicou suspender o envio automático, abrir chamado no provedor e avisar a comissão, e os boletins saíram a cada 30 minutos com o atraso visível no painel.

O resultado

Os pagamentos do período foram reprocessados no dia seguinte, o MTTR ficou registrado, e o processo de cobrança ganhou um RTO ajustado à realidade da empresa.

03

A véspera que mostrou o que faltava

O cenário

Na segunda-feira, a produção abriu a prontidão dos eventos da semana. Um baile de sábado parecia em ordem na agenda.

Com o sistema

A checagem mostrou duas vagas da escala ainda sem profissional e o laudo do local vencendo na sexta, um dia antes do evento. O plano de execução do evento existia, mas nunca tinha sido testado.

O resultado

As vagas foram preenchidas na terça, o laudo renovado na quarta, e um teste de mesa foi marcado com a equipe antes do baile seguinte.

04

O link de fotos que ficou público

O cenário

Um formando avisou que conseguia abrir a galeria de outra turma por um link compartilhado. A primeira reação foi apagar o link e seguir em frente.

Com o sistema

A triagem marcou exposição de dado pessoal, e o incidente nasceu SEV1. O plano de vazamento indicou acionar o encarregado de dados, preservar evidências antes de limpar e levantar quais titulares foram afetados, e o comunicado a titulares saiu do modelo com os campos revisados.

O resultado

A exposição foi contida com os registros preservados, a avaliação de comunicação à ANPD ficou documentada no prazo pelo registro de privacidade aberto da própria sala, e o pós-mortem não pôde ser publicado enquanto não tinha causa raiz além do nome de quem gerou o link.

05

O baile no jardim com previsão de chuva

O cenário

Na quinta-feira, a formatura de sábado num espaço ao ar livre ainda estava marcada como em ordem. A coordenação só olhava a previsão no celular, cada um num aplicativo.

Com o sistema

Na prontidão, a previsão do dia mostrou 75% de chance de chuva e apontou o plano de chuva em evento externo, que estava vigente. A diretoria registrou go com ressalvas, com a justificativa de montar a tenda, e a decisão ficou gravada com as checagens daquele momento.

O resultado

A tenda foi contratada na sexta, o contato do fornecedor entrou no kit de crise impresso do evento e, quando choveu às 21h, a equipe já sabia o que fazer.

Glossário

Os termos de resposta a incidente, ditos em português

O painel escreve tudo em português. Se você chegou procurando pelos termos de mercado de gestão de incidentes e continuidade de negócios, é isto que cada um deles é aqui dentro.

IncidenteIncident
O problema promovido a resposta coordenada, com severidade, comandante, marcos e linha do tempo. Nem toda ocorrência vira incidente.
SEV1 a SEV4Níveis de severidade
A régua de gravidade do incidente, do crítico ao baixo, com critério escrito e prazo de resposta para cada nível.
ComandanteIncident commander
A pessoa que decide durante o incidente. É uma só, e os outros papéis dividem o trabalho sem dividir o comando.
BoletimStatus update
A atualização de situação publicada durante o incidente, interna ou para comunicar, com prazo definido pela severidade.
MTTATempo médio até reconhecer
Quanto tempo, em média, passa entre a detecção e o reconhecimento de um incidente.
MTTRTempo médio até resolver
Quanto tempo, em média, passa entre a detecção e a resolução de um incidente.
SLAPrazo de resposta
O tempo máximo para reconhecer, atualizar e resolver cada severidade. Os padrões vêm do código e a empresa ajusta.
BIAAnálise de impacto no negócio
O levantamento de quais processos param a empresa e em quanto tempo precisam voltar. Aqui é a tela de processos críticos.
RTOTempo de recuperação
Em quanto tempo o processo precisa voltar a funcionar depois de parar.
RPOPonto de recuperação
Quanto de informação a empresa aceita perder quando o processo para. Zero quer dizer nada.
Plano de contingênciaRunbook
Os passos por fase que a equipe segue quando um processo para, com responsável e prazo.
Pós-mortemBlameless postmortem
O relato do incidente depois de resolvido, com causa raiz, fatores e ações, escrito sem procurar culpado.
Cinco porquês5 whys
A técnica de perguntar por que várias vezes seguidas até chegar na causa que, corrigida, impede a repetição.
Teste de mesaTabletop exercise
O ensaio de um plano com a equipe reunida discutindo o cenário, sem executar de verdade.
Continuidade de negóciosBusiness continuity
A preparação para que os processos essenciais continuem, ou voltem no tempo combinado, quando algo sai do controle.
PlantãoOn-call
A pessoa escalada para atender quando algo acontece fora do horário, com um primário e um secundário.
Go/No-GoDecisão de seguir
A decisão registrada de manter, manter com ressalvas ou não realizar o evento, tomada com as checagens de prontidão à vista.
Kit de criseCrisis kit
O plano, os contatos e os comunicados reunidos numa página para imprimir e levar para o evento.
Fornecedor críticoCritical supplier
O fornecedor sem o qual um processo crítico para, e que por isso precisa de substituto definido.
MaturidadeBusiness continuity maturity
A nota que diz quão preparada a empresa está, medida sobre o que ela registrou, e não sobre uma autoavaliação.

Dúvidas

As perguntas que aparecem na avaliação do módulo

O módulo substitui o registro de problemas da Produção de Eventos, do SST ou do Suporte?

Não. Cada ocorrência continua sendo registrada no módulo dono dela. O radar lê esses registros na hora, e só o que precisa de resposta coordenada é promovido a incidente, que guarda a referência à origem.

Preciso cadastrar processos e planos antes de usar?

Não. Os doze processos críticos, os doze modelos de plano e os sete modelos de comunicado vêm prontos, e as dependências são lidas da configuração da plataforma. A empresa ajusta o que for diferente na realidade dela.

O sistema manda a mensagem para os formandos sozinho?

Não. O comunicado é redigido a partir do modelo com os dados do incidente, a pessoa revisa, envia pelo canal de sempre e registra o envio. Esse registro conta como boletim para o prazo da severidade.

Posso mudar os prazos de cada severidade?

Pode ajustar os prazos de reconhecimento, boletim e resolução, dentro de limites que mantêm a ordem entre os níveis. O critério de cada severidade continua sendo o do código.

Todo incidente precisa de pós-mortem?

SEV1 só encerra com pós-mortem publicado, e a empresa pode ligar a mesma trava para SEV2. Os demais podem ter pós-mortem quando fizer sentido.

O módulo monitora se a plataforma está no ar?

Não. Monitoramento técnico de disponibilidade fica em outra ferramenta. Aqui fica a coordenação da resposta e a preparação da empresa, inclusive o plano para quando o app ou o painel ficarem fora do ar.

Funciona sem os módulos de SST, Compliance ou Qualidade?

Funciona. O radar mostra as fontes que existem no ambiente e avisa quais não estão disponíveis, sem quebrar a tela. O mesmo vale para as dependências e para a prontidão dos eventos.

Existe escala de plantão com ligação automática?

Existe escala de plantão, com primário e secundário por período, quem está de plantão agora e os buracos da escala. Ligação automática não: o aviso de SLA estourado chega pelo sino, e o telefone de quem está escalado aparece no painel, na sala do incidente e no kit de crise.

O sistema avisa quando o prazo do incidente estoura e ninguém está olhando?

Avisa. A cada dez minutos ele confere os SEV1 e SEV2 abertos e manda aviso no sino para os administradores e para o comandante quando o reconhecimento ou o boletim atrasa, uma vez por estouro.

A previsão do tempo precisa de alguma configuração?

Não. Ela usa um serviço aberto, sem chave, e é consultada sob demanda para eventos dos próximos sete dias. A cidade vem do cadastro ou do texto do local do evento, e a tela mostra qual foi usada.

Um plano que existe antes do problema, e um comando que aparece quando ele chega

Podemos abrir o radar com as ocorrências da sua operação, simular um incidente do dia do evento, acionar um plano pronto na sua frente e falar sobre o caminho de implantação na sua realidade.