1.
准备工作:确定测试环境与复现条件
- 确认测试设备:优先使用有线的台式机或笔记本(Linux/macOS/Windows),关闭代理或本地 VPN。
- 确认测试时间点:记录测试的年月日与精确时间(含时区),有助于服务商查看对应时段链路状态。
- 准备记录方式:新建文件夹保存所有输出(ping、traceroute、MTR、speedtest、tcpdump、iperf3、截图)。
2.
本地基础排查:物理与局域网检查步骤
- 检查链路与速率:确认网线、光猫、交换机端口速率是否为预期(1000Mbps 或 100Mbps)。查看设备 LINK/ACT 指示灯。
- 排除无线干扰:优先做有线测试;若只能用无线,靠近路由器并用5GHz频段。
- 重启流程:依次重启终端 → 交换机/路由器 → 光猫,重启间隔至少30秒,再测试是否恢复。
3.
进行基础延迟与丢包测试(Ping)
- Windows 指令:ping -n 100 <目标IP或域名>,记录丢包率和平均延迟。若怀疑 MTU 可用:ping -f -l 1472 <目标IP>。
- Linux/macOS 指令:ping -c 100 <目标IP>,检测丢包与延迟分布;MTU 测试:ping -M do -s 1472 <目标IP>。
- 建议目标:先 ping 香港 CN2 测试服务器或已知稳定的 CN2 目的 IP,若不知道可使用 ISP 提供的测速域名或 speedtest 的 HK CN2 节点。
4.
路径分析(traceroute / tracert / tcptraceroute)
- Windows:tracert -d <目标IP>(-d 禁止反向 DNS,加快输出)。
- Linux:traceroute -I <目标IP>(ICMP)或 traceroute -T -p 443 <目标IP>(TCP 443,避免设备丢弃 ICMP)。
- 目标:观察到达香港前最后几跳是否在中国电信 CN2 网络或是否出现跨网段跳数异常、高延迟跃点、星号丢包等。
5.
使用 MTR 或 WinMTR 做持续路径/丢包观测
- Linux:mtr -rwzbc 100 <目标IP>(r:报告模式,w:宽输出,z:压缩,b:显示双向,c:次数)。
- Windows:下载 WinMTR,运行对比多个目标,导出 CSV,重点看哪些跃点出现稳定丢包或高延迟。
- 说明:若中间跃点(通常靠近 PE/核心)持续丢包但目的地无丢包,可能是路由器对 ICMP 低优先级丢弃,需要结合其他测试判断。
6.
带宽与并发测试(speedtest 与 iperf3)
- Speedtest:使用 speedtest.net 或 ISP/speedtest 提供的 CN2 香港节点,记录下载/上传/延迟并保存截图与结果链接。
- iperf3:在本地运行 iperf3 客户端连接到香港的 iperf3 服务器(若有)。命令示例:iperf3 -c
-P 10 -t 60 -R(-R 测试服务器到客户端反向)。
- 分析:若 speedtest 与 iperf3 结果一致说明链路承载问题,若差异说明可能是速测节点或 TCP 优化差异。
7.抓包与深层分析(tcpdump / Wireshark)
- Linux tcpdump 示例:tcpdump -i eth0 host <目标IP> and tcp -w /tmp/cn2_hk.pcap。记录开始与结束时间。
- 采集要点:包含三次握手、重传、TCP 窗口、ICMP 超时信息。使用 Wireshark 打开 .pcap,过滤 tcp.analysis.retransmission、tcp.analysis.duplicate_ack 等。
- 保存证据:将 pcap、Wireshark 的统计图、TCP 流导出为文本,一并提交给服务商。
8.检查本地网络设备错误与队列
- 交换机/路由器接口检查(Cisco/Huawei 示例):Cisco “show interface GigabitEthernet0/1” 查看 CRC、input errors、output errors、drops;Huawei “display interface GigabitEthernet0/0/1”。
- 如果存在 input errors、CRC 或 interface resets,应先确认物理层(换线缆、换端口)并拍照/记录日志。
- 检查 QOS/流量整形策略是否限速或 shaping,临时关闭进行对比测试。
9.BGP 与路由策略检查(路由可达性)
- 本地或服务商 BGP 信息:若有边界路由器权限,运行 show ip bgp neighbors / show bgp ipv4 unicast summary 查看邻居状态与 prefix 接收情况。
- 使用外部 Looking Glass(如 bgp.he.net、routeviews)查询到香港的最佳路径,确认是否有异常路由绕行或不常见的社区标记。
- 若发现路由不在 CN2 期望路径上,记录 traceroute 与 BGP 输出以供报障。
10.与服务商沟通前要准备的证据清单
- 必备内容:测试时间区间(精确到秒)、源 IP、目标 IP/域名、speedtest/iperf3 的原始结果与截图、traceroute/MTR 导出文件、tcpdump pcap、设备接口统计截图(错误/丢包)。
- 说明影响范围:是否只是单台机或全网、仅某个服务或全部香港目标、是否为高峰时段。写清复现步骤便于服务商快速复现。
11.如何撰写与提交报障工单(模板与要点)
- 标题模板:CN2香港链路异常-(客户名称)-(电路号/VLAN)-(发生时间)
- 工单正文要点:1) 问题描述 2) 影响范围 3) 复现步骤 4) 已做的本地排查与结论 5) 附件(按清单) 6) 要求(如请检查 PE/链路错误、查 LSP、提供 PE -> CE 流量镜像或 PCAP)。
- 示例请求:请运维在出现异常时抓取 PE/核心的 pcap,检查 MPLS LSP 丢包、查看是否存在黑洞或策略限速,并在 2 小时内回复初步原因。
12.升级与后续处理建议
- 若一线响应慢:要求转到二线或核心网络团队,提供已收集的全部证据并电话跟进。
- 需要临时缓解方案:请求服务商在 PE 侧或转接路由上做流量调优、绕路或临时增加 QoS 优先级。
- 事后复盘:问题解决后要求服务商提供故障根因分析(RCA)文档,包含故障起止时间、影响范围、修复措施与防范建议,并保存备查。
13.常见误区与排查提醒
- 不要只看 speedtest:单一测速可能被 CDN/节点影响,建议结合 traceroute、iperf3 与 MTR 多角度判断。
- ICMP 丢包不等于业务丢包:部分网络设备对 ICMP 低优先级处理,应用 TCP/UDP 实测确认。
- 保留原始文件:服务商可能会要求原始 pcap、MTR CSV 与设备命令行输出,截图不够。
14.常见问答:CN2香港测速异常常见原因是什么?(问)
- 回答:常见原因包括:本地链路质量问题(网线/端口错误)、局域网拥塞或 QoS 限速、PE/核心链路拥塞、错误的路由策略或旁路(非 CN2 路由)、设备对 ICMP 的降优先级、以及临时维护或物理故障。通过上述 ping/traceroute/MTR/iperf3 与抓包可快速缩小范围并定位。
15.常见问答:服务商通常会如何处理我提交的问题?(问)
- 回答:服务商通常会先核对电路与端口状态、查看 PE/核心设备错误与流量统计、复现您的 traceroute/MTR,并在核心侧抓包或做 MPLS LSP 测试。如果怀疑设备或光路,会安排本地网管/维护上门或与骨干网团队协作进行修复,并在工单中反馈 RCA。
16.常见问答:如果服务商处理慢,我该如何升级?(问)
- 回答:先电话催单并要求二线或核心网组介入;提供完整证据并明确 SLA 期望;若无果,可请求管理级联系方式或客户经理介入,并在工单中注明业务影响与紧急等级(如影响生产系统)。同时准备备选线路或临时 VPN 绕路以减轻业务压力。
来源:cn2 香港测速遇到异常如何定位问题并联系服务商处理