Coleta que cobre a rede inteira
SNMP em roteadores, switches e OLTs, com template por modelo e descoberta automática de interface e porta PON.
Consultoria
Monitoramento não serve para provar que a rede caiu. Serve para avisar antes do cliente ligar e para dizer onde está o problema quando ele acontece. A maior parte das instalações que eu encontro não faz nenhuma das duas coisas.
Se pelo menos dois desses itens descrevem a sua rede hoje, o diagnóstico costuma pagar o próprio custo já na primeira correção.
SNMP em roteadores, switches e OLTs, com template por modelo e descoberta automática de interface e porta PON.
Limiar por tipo de elemento, dependência entre itens e supressão em cascata. Um enlace que cai gera um alerta, não quarenta.
NetFlow ou sFlow respondendo quem consumiu o quê, para onde e em qual horário.
Syslog agregado, com retenção definida e busca útil na hora do incidente.
Uma visão para o NOC, uma para a diretoria e uma para o time de campo. Cada uma responde perguntas diferentes.
O que existe na rede, o que já é monitorado e o que está invisível hoje.
Definição dos indicadores que realmente antecipam falha, antes de instalar qualquer coisa.
Coleta, alertas e painéis, seguidos de duas a quatro semanas de calibragem contra falso positivo.
A equipe interna precisa saber ler o painel e agir. Sem isso, o projeto vira enfeite.
Zabbix se encaixa melhor em rede de provedor, porque SNMP, descoberta de interface e dependência entre itens são nativos. Prometheus brilha em aplicação e container. Em muitos clientes os dois convivem, cada um no seu papel.
Dá. Potência óptica, alarme de PON, quantidade de ONTs por porta e queda em massa entram como itens monitorados, com alerta separado do resto da rede.
Se já existe Zabbix, prefiro sanear o que está lá: costuma ser mais rápido e preserva o histórico. Reinstalação só quando a base atual não tem conserto.
A coleta sobe em dias. Alerta confiável exige de duas a quatro semanas de ajuste contra falso positivo, e essa etapa faz parte do escopo.
Perda intermitente, latência sem causa aparente e rota que some. Diagnóstico com captura de pacote e laudo com evidência.
SuporteDimensionamento de OLT Huawei MA5800, padronização de line e service profile, provisionamento em escala e integração com ERP.
FibraConsulta pública de BGP, ping e traceroute a partir da sua borda, sem expor o roteador e com página de informações do AS.
DiagnósticoConte o que está acontecendo na sua rede hoje. Eu respondo com as perguntas técnicas que faltam e, quando o caso está claro, com uma proposta de escopo fechado.
Respondo em até 1 dia útil. Segunda a sexta, das 9h às 18h (horário de Brasília).