IPv6 故障排障思路,借助 IPv6 Ping 缩小问题排查范围
双栈业务上线之后,出现 IPv6 环境访问不稳定、连接失败的情况,缩短故障定位时间,就可以降低业务受到的负面影响。IPv6 Ping 是整套 IPv6 排查流程当中实用性很强的一环,掌握合理排障思路,可以减少很多无效操作,快速锁定问题大致区间。
用户反馈 IPv6 网络下业务连接异常,很多人第一反应在本地做测试,本地访问一切顺畅,就判定服务器 IPv6 不存在问题。忽略不同地区运营商 IPv6 线路之间客观存在的性能差异,很容易停滞在排查初期。IPv6 Ping 跳出本地网络局限,从多个探测源完成探测,看清不同区域的链路真实状态。
IPv6 Ping 输出往返延迟和丢包两项关键参考指标。延迟代表数据包传输耗时,数值越高访问响应越慢。丢包代表数据包传输丢失,丢包占比越高,越容易出现业务断断续续、请求失败。稳定可用的 IPv6 业务链路,应当维持合理延迟,尽量做到零丢包。
对比 IPv6 Ping 各个节点返回的数据,可以区分故障影响范围。个别节点探测异常,大概率属于局部网络波动。大量节点同时超时、高丢包,优先排查服务器 IPv6 地址、AAAA 解析记录以及安全组配置。
运维场景经常遇到探测节点请求超时,普通 IPv6 用户业务访问却全部正常。这是服务器防火墙拦截 ICMPv6 探测报文带来的结果,业务流量不受影响,不能凭借 IPv6 Ping 超时判定服务器故障,这时就需要切换业务层面检测手段开展核验。
网络排查不能止步于 IPv6 Ping 给出的报告。IPv6 网络问题成因复杂,各类因素都可能引发连通异常。IPv6 Ping 提供排查线索,顺着线索开展其他维度检测,一步步缩小问题范围,理清故障成因,推动问题快速修复,维护双栈业务持续稳定可用。