海缆中断后切换路由,核心逻辑是迅速将流量从故障路径迁移到备用的物理链路或逻辑隧道上,优先保证核心业务可用,再逐步恢复最优路径。这就像城市主干道塌方,交警不会等路修好,而是立刻引导车辆走环线、走辅路,服务器流量调度也是同理,提前规划好“绕行方案”比临场发挥重要得多。
停网瞬间:先别急着改路由,先确认故障在哪
很多新手一看到延迟飙升就手动切路,结果把没断的线路也搞乱了,海缆故障通常有预兆,比如跨太平洋方向丢包率突然从0.1%跳到30%以上,或者国际出口的TCP重传率异常升高。
此时你要做的第一步不是切换,而是定位故障边界。
- 确认是本地机房到上级路由器断开,还是国际出口整体拥堵
- 用
traceroute或mtr检查故障节点的大致位置,是海缆登陆站还是回程骨干网 - 检查路由协议邻居状态,看看BGP会话是否还在建立中
多数情况下,海缆中断表现为国际方向的路由不可达或高丢包,而国内链路、同城互联不受影响,确认了这一点,你才能判断是只改出口线路,还是需要把整个VPC的网关节切换到备用地域。
海缆中断后如何切换路由:两条主路线
业内专家指出,路由切换的本质是“改下一跳”,但具体实现方式要根据你的业务架构决定,核心是用备用链路覆盖故障链路,而不是删除故障路由。
跨地域专线或IPLC用户:改静态路由优先级
如果你租用的是IPLC或IEPL这类物理专线,出现了断缆,运营商通常会帮你临时调度到其他海缆段,但如果你有自建的双线冗余,就需要手动把静态路由的优先级调低。
操作路径大致如下:
- 登录核心路由器或交换机,找到指向故障方向的静态路由条目
- 将备用线路的路由优先级(如
distance值)从原本的150改成50 - 同时将故障线路的
distance值调高到200,实现“被动失效” - 观察路由表中下一跳的变化,确认流量已切换到备用链路
这里的关键在于不要删除故障路由,因为海缆恢复时间不确定,保留条目并调低优先级,恢复后就只需改回数值,不用重配。

BGP用户:用AS路径和本地优先级引导流量
大多数国际带宽服务器走的是BGP协议,海缆中断时BGP邻居可能还在,但链路质量已经不可用,此时切换路由靠的是调整BGP属性。
- 在入方向,对备用链路的对端前缀设置更高的
local-preference,比如设为200 - 在出方向,对备用链路的出口流量增加
AS_PATH预pend,让上游觉得这条路径“更长”但可用 - 如果同时有多条BGP会话,优先将低质量链路的
max-prefix限制临时调低,强制其失效
有个实操技巧:不要等BGP自动收敛,海缆故障会导致路由震荡,BGP的收敛时间可能长达十几分钟,你要做的是提前在备用链路路由器上写好策略,一旦监测到故障立即手动执行,而不是依赖协议自己切换。
香港服务器CN2线路断了怎么切到备用链路
香港是国际带宽服务器的热门地域,但香港到美国方向的海缆故障频率并不低,如果你用的是CN2 GIA线路,一旦发生国际方向断缆,切换思路和普通BGP略有不同。
CN2线路的特点是去程走电信CN2,回程也走CN2,它的核心优势是低延迟,但海缆中断时,CN2也会绕路,此时切换方案应该分两步走:
- 第一步:将业务流量切到备用IP或备用机房的公网IP上,前提是服务器本身有跨境容灾
- 第二步:在DNS层面将解析切换到备用地域的A记录,并调低TTL值,让客户端更快感知新IP
很多做外贸站的用户会问,为什么海缆断了,香港服务器访问美国还是通,但延迟从60ms跳到了200ms?这就是因为CN2自动绕到了欧洲或东南亚的海缆段,这种情况下,切路由不如切地域直接启用美国本土的VPS或裸金属服务器作为临时出口,效果更直接。
具体操作建议:
- 在DNS服务商处预先配置好备用IP,并设置TTL为60秒
- 写一个健康检查脚本,每30秒ping一次目标段IP,连续丢包超过5次就自动切换
- 备用地域优先选择新加坡、东京、洛杉矶这三个节点,因为它们与香港之间的直连带宽资源较充足
切换路由时,IP不变才是王道
很多用户有一个误区:以为切路由就必须换IP,实际上高可用架构下的路由切换,IP是保持不变的

,这要归功于BGP的Anycast技术和隧道技术。
用GRE或VxLAN隧道包一层
如果你的服务器只有固定的一个公网IP,但物理链路有多条,可以在主链路和备用链路上分别建立GRE隧道到核心交换机,对外只公布隧道的出口IP,内部路由走隧道转发。
这样做的好处是:
- 海缆中断时,只需切换隧道内层路由的优先级
- 客户端的TCP连接不需要重建,避免了会话中断
- 兼容性极好,不需要改DNS或重新配IP
行业共识认为,对于企业级应用,使用隧道封装切换路由是比裸BGP更稳的做法,因为隧道内部可以跑OSPF或静态路由,控制粒度更细。
用SD-WAN做应用层分流
如果你预算充足,可以考虑在服务器前加一层SD-WAN设备,SD-WAN能实时监测国际链路的丢包和延迟,当海缆中断时,它在毫秒级内把流量切到备用链路,甚至能做到同一个TCP连接的不同包走不同路径。
但要注意,SD-WAN对国内到国际的跨境链路优化效果有限,更推荐用于海外节点之间的互联。
切完路由之后:验证和回切同样重要
路由切换不是“切完就完事”,后续的验证步骤决定了业务能否稳定运行。
- 先检查TCP连接的新建成功率,用
curl -I或nc -vz测试目标端口 - 再用
ping和traceroute对比切换前后的路径延迟,确认流量确实走了新链路 - 观察5分钟内的丢包率,一般在备用链路下丢包率应低于3%
- 如果你用的是BGP切换,查看
show ip bgp summary,确认对等体状态稳定无震荡
回切操作更考验耐心,海缆修复后,运营商通常不会主动通知你,建议每天固定时间检查一次国际链路的延迟和丢包,当连续两天延迟恢复正常值,再考虑回切。
回切时不要一次性全量切回,可以先切10%的测试流量,观察半小时,再逐步放量,切忌在海缆恢复当天就马上回切,因为修复后的海缆初期运行状态不稳定,经常会出现“修复后再次故障”的情况。
长期主义:平时做的准备决定了故障时的响应速度
海缆中断的切换路由,本质上是一场“有准备的仗”,如果你在正常情况下没有部署冗余链路和自动化监控,断缆那刻再抢修就太晚了。

- 至少准备两条物理上不同路径的链路,避免走同一条海缆
- 与供应商签署的合同中明确写入“海缆故障时提供临时国际带宽”的条款
- 每季度做一次路由切换演练,确保备用链路的认证信息和配置没有过期
- 托管机房的电力、空调和上联带宽都要有冗余,防止“断缆+宕机”双杀
对于预算有限的个人站长,一个务实的做法是用“国际BGP+国内优化”的组合,比如主力服务器放在香港,同时在美国或日本买一台低配VPS作为备用出口,平时走香港直连,断缆时手动改DNS解析到备用VPS上,虽然不是毫秒级切换,但比无备份强得多。
香港服务器与国际带宽故障排查的常见问题
海缆中断后,香港服务器访问美国网站时通时不通,这是为什么?
因为BGP路由收敛是逐步完成的,运营商骨干网上的路由器需要逐跳更新转发表,这个过程中部分路由会指向旧的、已失效的下一跳,导致丢包,通常在海缆中断后10到30分钟内,这种不稳定状态会逐步消失,你可以暂停所有手动操作,等待网络层收敛,然后再做路径验证。
使用备用链路后,延迟还是很高,怎么办?
备用链路往往要绕行其他海缆或陆地光缆,物理距离变长,延迟升高是正常现象,重点应关注丢包率而非延迟绝对值,如果丢包率低于1%,业务体验通常可接受,若丢包率仍在5%以上,建议将TCP拥塞控制算法切换为BBR,能在高延迟高丢包链路下明显提升吞吐效率。
国际大带宽服务器是否需要实时监控路由状态?
需要,但你不需要自己搭建复杂的监控平台,简单的脚本就能解决,每5分钟执行一次mtr -r -c 50到目标IP,记录loss和avg字段,设置阈值报警,这样既能记录海缆故障的完整时间线,也能为后续与运营商沟通提供依据,更重要的是能在故障发生的第一时间触发切换动作。
海缆中断并不可怕,可怕的是没有预案,用好路由优先级、BGP策略和备用链路,你的服务器完全可以做到“断缆不中断”,把每一次切换都当成一次演练,你的国际带宽业务就能长期保持稳定跑在最优路径上。