Eventos e massivas

Como uma queda vira evento com sinal antes e depois, e como quedas concomitantes viram uma massiva com escopo identificado.

O monitoramento responde se uma ONU está fora agora. Isso serve ao plantão e não serve ao diagnóstico. Para saber por que ela caiu é preciso saber quando caiu, em que condição estava no instante anterior e quem mais caiu junto.

De queda a evento

Uma queda não é um estado; é um ciclo. O evento de indisponibilidade guarda o ciclo inteiro: o instante em que a ONU saiu do ar, o instante em que voltou e o sinal óptico registrado nos dois momentos. Enquanto a ONU não volta, o evento está aberto — e é ele que responde “há quanto tempo”.

O valor que mais pesa aí é o sinal imediatamente antes da queda, e ele tem uma característica incômoda: só existe se alguém estava medindo antes. Depois que a ONU some, não há como recuperá-lo. Fibra rompida e equipamento desligado na tomada não deixam a mesma assinatura no último valor lido — é a distinção que Monitoramento usa para separar causa provável de palpite, e é ela que o evento preserva depois que a queda passa.

Ordenar hipóteses não é emitir laudo: um rompimento súbito também pode não deixar aviso na medição anterior. O que esse valor decide é qual hipótese se testa primeiro e, na prática, se o próximo passo é uma ligação para o assinante ou um deslocamento. Sem ele, as duas chegam empatadas à mesa.

O evento não desaparece quando a ONU volta. Ele fica no histórico daquela ONU, e é o que permite responder, semanas depois, se aquilo já acontecia antes — a mesma pergunta que o ranking de quedas responde no agregado.

Quando várias caem juntas

Quedas concomitantes que compartilham um ponto da topologia são agrupadas automaticamente numa massiva. Ela já nasce com um escopo provável apontado, e é o escopo que muda a decisão:

EscopoO que a coincidência aponta
Porta PONa árvore inteira abaixo de uma porta: tronco, primeira divisão ou a própria porta na placa
Placaportas diferentes da mesma placa ao mesmo tempo: o módulo é a hipótese mais direta, com a ressalva de que alimentadores de portas vizinhas costumam sair no mesmo cabo
OLTa cabeceira inteira: falta de energia no POP ou o próprio equipamento
CTOuma caixa e os assinantes dela — dano na caixa, no cabo que a alimenta, obra no poste, falta de energia no trecho

A distância entre essas quatro linhas é a distância entre acionar quem cuida do POP e despachar alguém para um poste. Agrupar sem apontar escopo resolveria pouco: saber que quinze caíram juntas não diz para onde ir.

O escopo é provável, e a palavra está aí de propósito. O agrupamento parte do que a topologia e o cadastro afirmam, e o cadastro pode estar errado. ONUs registradas na caixa errada espalham uma queda única entre caixas sem relação entre si, ou reúnem numa CTO assinantes que não estão nela. É por isso que a divergência CTO/PON é trabalho preventivo: quem não a faz antes paga durante o incidente. A diferença entre as duas referências está em Topologia.

Há ainda a coincidência que não é topológica. Quinze quedas em CTOs diferentes do mesmo quarteirão não compartilham um ponto da árvore, e é o compartilhamento que o agrupamento procura; essa coincidência aparece no mapa da rede.

A janela de concomitância e o limiar de cada escopo são ajustados por instalação. Não há um número que sirva a todas: numa planta densa, três quedas na mesma CTO em dois minutos é rotina de fim de tarde; em outra, é incidente. A calibragem é parte da implantação, e vale revisá-la depois que a operação viu o agrupamento funcionando com dados reais.

O que o operador faz com uma massiva

A massiva não é só leitura: ela tem três ações. Elas existem para responder à pergunta que a equipe faz entre si no meio do incidente — alguém está vendo isso?

  • Assumir — alguém está cuidando. A massiva deixa de ser um alerta sem dono e passa a ter um responsável visível para o resto da equipe. É a ação que ajuda a evitar duas pessoas diagnosticando a mesma coisa em turnos que se sobrepõem.
  • Resolver — acabou. Encerra a massiva e marca o fim do episódio para quem precisar reconstruí-lo depois.
  • Descartar — registra que aquela coincidência não vai ser tratada como incidente; tipicamente quedas independentes que calharam de acontecer juntas. É dizer isso explicitamente, em vez de deixar aberta uma massiva que ninguém vai tratar.

As três acontecem na mesma tela em que a massiva está sendo observada. Não há passo intermediário entre ver o agrupamento e registrar o que a equipe decidiu sobre ele — e é o passo intermediário, onde quer que ele viva, que costuma ficar desatualizado primeiro.

O descarte é final para aquele agrupamento: a massiva descartada não volta a se formar, mesmo que as quedas persistam. Quedas novas podem gerar outra massiva depois — o que não acontece é a plataforma reabrir a decisão que a equipe já tomou. O descarte é uma decisão registrada, não um adiamento.

As três são permissões distintas entre si, e nenhuma vem junto com a leitura da massiva: quem atende pode acompanhar o incidente sem poder descartá-lo. O modelo está descrito em Controle de acesso.

Fechamento automático

Uma massiva pode terminar sem que ninguém clique em nada. Quando todas as ONUs que a compõem voltam, ela se resolve sozinha, com o fim marcado no instante em que a última voltou.

Até lá, ela acompanha a volta de cada uma. A ONU que retorna aparece como restabelecida, com o horário da volta, e deixa de contar entre as afetadas — sem apagar o pico, que continua visível. É o que mostra, no meio do incidente, se a recuperação está andando ou parou.

Basta uma ONU que não voltou para manter a massiva aberta, e isso é deliberado. A plataforma não tem como saber sozinha se aquela ONU ficou para trás por um motivo só dela, alheio à causa comum, ou se é a causa comum que ainda não se resolveu por inteiro. Fechar ali seria declarar o incidente encerrado no lugar da equipe, e uma massiva fechada cedo demais tende a esconder justamente o resto do problema.

Essa decisão é do operador, pela ação Resolver, e vale como a do descarte: resolvida assim, a massiva não volta a se formar com as mesmas quedas. O que a resolução encerra é a participação de cada membro na massiva, e não o estado dele. Uma ONU que continua fora do ar continua fora do ar na lista e no mapa, agora como caso individual — que é o que ela passou a ser quando a causa comum deixou de explicá-la.

Por que isso muda o suporte

Quando a primeira notícia de um incidente é a ligação do assinante, os primeiros minutos do atendimento são gastos descobrindo que existe um incidente. Cada ligação chega como um caso isolado e abre o seu próprio diagnóstico; a percepção de que são o mesmo caso se forma depois, quando alguém nota o padrão.

A massiva não depende do telefone para existir. Ela se forma a partir das quedas que a plataforma leu, e existe mesmo que ninguém tenha ligado ainda. Quando ela já está aberta e assumida no momento em que a ligação chega, o atendente vê que aquela queda já tem dono — e a resposta deixa de ser “vou verificar” e passa a ser uma informação de estado.

Duas ressalvas, porque essa diferença não é automática. A primeira é que a massiva estar aberta e a equipe saber que ela está aberta são coisas distintas: a abertura aparece na plataforma, e não sai dela — não há notificação externa, de modo que saber depende de alguém com a tela na frente. Vale aqui o mesmo que vale para os alarmes do monitoramento.

A segunda é que a plataforma entrega o agrupamento, o escopo e o dono — não o roteiro de atendimento. O que se diz ao assinante, e se algo é dito antes de ele ligar, continua sendo decisão do provedor.

Por onde continuar

  • Relatórios — onde os eventos viram consulta: quedas por período, ranking e as divergências de cadastro que atrapalham o agrupamento.
  • Mapa da rede — a coincidência geográfica, que o agrupamento por escopo não enxerga.
  • Controle de acesso — como a plataforma decide quem pode fazer o quê.

Atualizado em 28 de setembro de 2026