MES3324F 上一段 27 公里的链路:同样的模块在 MXA-64 上能起链路,Eltex 却把端口打到 PORT_SUSPENDED
我们两个节点之间的对接:大约 27 公里的单模链路,两端都是 MES3324F。装了一对 1550 nm 的 FANG HANG SFP,卖家说是 40 公里的型号。链路能起来,维持几十秒之后就掉,如此循环,直到端口被锁住。
- 2 台 Eltex MES3324F,固件 4.0.7
- SFP FANG HANG 1550 nm,部件号 S1253271221932,标称 40 公里
- 大约 27 公里单模链路,两个节点都经过配线架
console# show fiber-ports optical-transceiver
Port ... Output Power Input Power LOS
gi1/0/23 -6.11 dBm -22.00 dBm No
%LINK-W-PORT_SUSPENDED
已经检查过的:
- 测量过整条线路,光缆本身没有问题
- 把同一对模块和同样的跳线搬到 MXA-64 上、接在同一根光纤上——链路立刻起来,而且没有翻动
- 把两个模块互换位置,插到相邻的光口——现象一样
接收端 -22 dBm 我自己也不太满意,但这样一来又说不通为什么在同一根光纤上 MXA-64 就能稳定工作。是 MES3324F 对贴近灵敏度极限的信号特别挑剔,还是问题终究出在模块上,需要重新找一对真正的 40 公里模块?不想跑一趟去买新模块,结果又撞上同样的问题。
Comments 4
1550 nm 千兆速率下接收端 -22 dBm,已经是极限边缘了,任何多余的一个接头都能决定成败。先问几个问题,不然就是瞎猜:
show fiber-ports optical-transceiver显示什么?我关心的是对端那里的 Input Power,不只是你这边的。按经验,商品描述里的「40 公里」和模块实际的有效距离经常是两码事,到了 27 公里这个距离,这个问题往往是第一个暴露出来的。
对端的情况是对称的,接收功率同样很低,差异在误差范围之内。关于模块:卖家最后承认这其实是二十公里的型号,不是四十公里,所以在 27 公里这个距离上,预算余量从一开始就不够。
同时也联系了 Eltex 的支持。回复很简短:检查收发器是否真的支持 DDM,升级固件,而且既然模块是千兆的,就在两端都加上
三件事都做了——端口最后还是走到了
%LINK-W-PORT_SUSPENDED,只是稍微晚了一点。老实说,MXA-64 那边的功率数值我们没测过,只看了链路是不是通的这个事实。现在在等一对预算余量足够、真正的 1550 nm 模块,在那之前我认为这个问题还没解决。
我在 Cisco 上碰到过类似的情况,只不过表现不是端口被锁,而是计数器里全是垃圾:两条光纤上联口里的一条,input errors 累积到 4.6 万,CRC 错误 4.2 万,日志里是 alarm Rx power low,-20.2 dBm,而阈值是 -18.4 dBm。
这个问题不是在交换机上解决的:清洁了两端的端面,用功率计测了 TX 和 RX,检查了线路长度、熔接点和跳线质量。一部分错误消失了,但功率数值始终没能完全恢复正常,最后还是换了模块。这说明在预算边缘,不同硬件的表现是不一样的:有的会累积 CRC 错误、假装还在工作,有的则老老实实把端口锁掉。所以你那边的 -22 不是「差不多能用」,而是已经构成故障原因了。
补充一点关于功率计测量的:便宜模块给出的 DDM 数字不能全信。就算是自己做光学诊断的正规厂商,对 Tx 和 Rx 也会声明大约 3 dB 的误差范围,温度大约 3 度的误差——这还是针对他们自家的模块。第三方模块上,和实际值差个几分贝完全正常,有时候模块干脆不给任何有意义的数据,那种情况下功率过低的提前告警根本就不会出现。DDM 里的告警阈值也是模块自己(按 SFF-8472)上报的,不是交换机自己算出来的。
有一套能省时间的排查顺序:先拿 Rx 数值跟模块自己的工作范围对比,而不是只看「链路有没有」;然后换跳线;再检查中间的配线架——最近有没有人动过;最后才怀疑对端的模块。我遇到过一次接收功率掉到 -25.69 dBm,最后查出来问题根本不在模块上,而在线路本身。