TL-SG3452P和PLANET IGS交换机:SM5110-SR不被识别,模块在笼子里发烫
小型办公室,两栋楼,我只想要一条简单的千兆光纤链路连接两个机架。两端都配置成1000M,但一直是暗的,这个问题已经拖了好几周了。
- TP-Link TL-SG3452P,硬件V3,固件3.20.4,链路从它的一个SFP笼子接出去
- 第二个机架里是PLANET IGS-6329-8UP2S4,另一条线路上还有一台IGS-R4215-24P4X
- 一端是SM5110-SR,另一端是SM311LM,中间是多模跳线
- PLANET那边的端口手动固定成1000M
交换机对这个模块完全没反应:
end A: SM5110-SR
end B: SM311LM
result: module not recognised, link never comes up
除此之外,SM5110-SR在笼子里放二十分钟之后明显发烫,比我们别处用的任何1G模块都烫,这才是真正让我担心的部分。
已经试过:
- 两边都升级了固件,没有变化
- 把模块在两对交换机的全部四个笼子之间轮换过,到哪里结果都一样
- 换了跳线并清洁了接头
这是模块兼容性问题,还是这些笼子有什么我没注意到的地方?一个交换机根本不认的模块,发这么烫正常吗?
Comments 4
这里叠了两个不同的错误。
第一个你自己已经发现了:SM5110-SR是SFP+的部件,而V3硬件版本的TL-SG3452P用的是普通1G SFP笼子。它能插进去,也能通电,但交换机根本没有能力驱动它,所以不管你刷多少个固件版本,它都不会被识别。
第二个是一个假设:以为把PLANET端口强制设成1000M就能解决另一端的问题。给笼子配置某个速率,并不能对插进去的模块说明任何事。每个模块都有固定的规格,不会因为端口配置的要求就改变自己的速率,所以两端必须用相同速率的模块,而且笼子本身要支持这个速率。
实际的修复办法是换成一对匹配的SM311LR模块,两端各一个,而不是你现在这种混搭。如果两台交换机之间的距离很短,大约3米以内,一根DAC更便宜,而且彻底不用再纠结模块的问题。
关于发烫的模块,我没有一个诚实的解释。一个根本没被驱动起来的部件不应该这么费力地工作,我也从没见过对这个现象有令人满意的解释。在你解决剩下的问题之前,我不会让它一直通电插在笼子里。
在有人能帮你之前,有一件事得先确定:每台交换机的笼子本身是什么速率的?TP-Link和PLANET这两款设备在这一点上根本不是一回事,端口配置界面也不会告诉你——在UI里选1000M,既不能说明这个槽位实际布线支持什么速率,也不能说明插在里面的光模块能干什么。去查每个型号的端口规格,而不是你在界面上选的那个速率。
查过了,这确实是该问的问题。TP-Link上的SFP笼子只支持1G——端口配置里根本没有10G这个选项。PLANET那边倒是有10G笼子,这也是我一开始要手动把它们强制降到1000M的原因。所以我这边是一个10G的部件插在一个只支持1G的笼子里。这能解释为什么它从来不被识别,但我还是不明白它为什么会发热。
值得补充一点:在这些交换机上,把笼子速率搞对还不是故事的全部。我这边看到的情况是,每次接的服务器重启,这条10G链路都会以1G的样子回来,而端口配置里依然坚持是10G。两台设备都这样:一台是1.30.0(HW V1)的TL-SG3428X,一台是1.20.0(HW V1.0)的TL-SX3008F,两台上都是真正的SFP+笼子。
我在主机这一侧折腾了好几周。先是Intel X520-DA2,然后换Mellanox卡,再换HP卡。先用Intel E10GSFPSR光模块,再换10GTek。Linux和Windows下试了一堆驱动版本。Omada里的配置文件也调过。甚至换过整个机箱。全都没用。反弹一下交换机,或者把端口速率从10G降下来再调回去,能重新拿回10G,但只能撑到下一次主机重启。
真正解决问题的是把第三方模块换成TP-Link的SM5110-SR,另外有人在SG3428XMPP和TL-SX3016F上也得到了同样的结果。所以光模块这一关要咬你两次:一次是笼子速率,一次是交换机在主机侧链路复位之后怎么重新协商。在批量下单之前,先在单个端口上试一个原厂模块。