PON 跟交换机网络不一样,ODN 这段从 OLT 到 ONU 全是分光器和光纤,中间没有一个有源设备能主动上报状态。光纤微弯、活动接头氧化、分光器受潮,这些毛病都不会立刻断网,而是慢慢把收光往下拖。等用户打电话说"上不了网",往往已经掉到灵敏度边缘。
把巡检从"出事才查"改成"定期主动查",隐患能在变成故障之前被捞出来。
登录 OLT,把每个 PON 口下挂 ONU 的收光(Rx)导成一张表。GPON 的 Class B+ 光模块接收灵敏度是 −28 dBm(ITU-T G.984.2),但别等到这个数才动手——收光低于 −25 dBm 就该警惕,低于 −27 dBm 基本是在悬崖边走。
发射功率(Tx)看 OLT 侧,正常在 +2 ~ +5 dBm。单口 1:128 分光时,末端 ONU 收光普遍在 −20 ~ −24 dBm 一带,属于健康区间。

光功率漂亮,链路不一定干净。翻 OLT 和上行交换机的接口计数,看 CRC 错包、码元错误是不是在涨。GPON 下行 2.488 Gbps、上行 1.244 Gbps(G.984.1),一点误码在高清视频业务上就是马赛克和卡顿。
CRC 偶发可以观察,持续上涨八成是光纤受压、接头脏或光模块老化,得顺着那条纤去查。
光模块商业级标称 0 ~ 70℃,工业级到 −40 ~ 85℃。机房空调一停,OLT 板卡温度往上窜,激光器波长漂移,收光就开始飘。巡检时读设备自带温度 sensor,超过 60℃ 就要查风道和防尘网,别等风扇停转才发觉。
OLT 告警里 LOS(信号丢失)、LOSi(帧丢失)最直白。某台 ONU 反复上下线,多半是光纤活动接头松了,或者光猫供电不稳。把近 7 天离线 ONU 排个序,Top 几台优先上门。
锐应 mini OLT L102P(2 口 GPON、单口 1:128 分光)支持 SNMPv3 北向,告警能直接推到 Zabbix,不用天天登 CLI 翻日志。
巡检完别只存在脑子里。把 OLT 当前配置、ONU 的 LOID 绑定关系、分光端口对应关系导出来存档。下次割接或换设备,这份底稿能省半天核对时间。
| 指标 | 正常区间 | 预警线 | 危险线 |
|---|---|---|---|
| OLT 收 ONU 光(Rx) | −8 ~ −22 dBm | < −25 dBm | < −27 dBm |
| OLT 发射(Tx) | +2 ~ +5 dBm | < 0 dBm | — |
| 端口 CRC 误码 | 0 增长 | 偶发 | 持续上涨 |
| 设备温度 | < 55℃ | 55 ~ 60℃ | > 65℃ |
| ONU 离线 | 0 | 单台偶发 | 多台 / 反复掉线 |
人工巡检适合几十台的小局点。ONU 过百,靠 SNMP 轮询加阈值告警才是正路。锐应 PON 方案里的 OLT 支持标准 SNMPv3(RFC 3414)和 MIB 读取,配合 Zabbix 这类开源网管,光功率越限自动发邮件,巡检从"人找问题"变成"问题找人"。
局点稳定、用户少于 50 户,每月一次够了;新建网络或近期动过光纤,前三个月每周一次。带企业专线、对称带宽要求高的,建议周巡检加日报阈值监控。
能通,但余量只剩 2 dB。活动接头再氧化一点、冬天光纤再收缩一点,随时掉到 −28 灵敏度假死。这种链路要排期整改,别等它断。
先看 CRC 误码和上行带宽占用。GPON 上行 1.244 Gbps 被上百户分时复用,晚高峰某几户大流量就能把其他人拖卡。再看 OLT 上联口是不是跑满了 GE。
先查光猫供电和光纤活动接头。收据显示 LOS 反复,九成是 SC/APC 接头松或冷接子老化;供电不稳会表现成规律性掉线,看日志时间戳就能分辨。
本地一份、离线一份(U 盘或网管服务器各一)。配置里含 LOID、VLAN、DBA 模板,丢一份恢复起来很麻烦,建议跟巡检记录绑在同一台账里。
PON 的故障大多不是突然来的,是慢慢烂的。一张巡检表、五个步骤,把光功率、误码、温度、告警这四类指标盯住,配合 SNMPv3 网管做自动阈值告警,运维从救火变成防火。规模上来之后,靠人盯不如靠系统盯。