给 VPS 做网络体检:iperf3、mtr、Looking Glass 与晚高峰实测方法论
2026-08-15 · DevCraft Studio
新开一台 VPS 别急着建站,先测网络。从 ping 看延迟/抖动,到 iperf3 打吞吐、mtr 看每一跳丢包、Looking Glass 验 ASN 与路由,再用晚高峰连续监测画真实质量基线。
新开一台 VPS,第一反应往往是赶紧装环境、传网站。但先停一下:机器跑得动,不代表网络扛得住。很多"买前千兆、用起来卡成狗"的落差,根源不在 CPU 或内存,而在链路质量。本文给你一套开箱即用的网络体检流程:先用 ping 看延迟与抖动,再用 iperf3 打吞吐、用 mtr 看每一跳丢包、用 Looking Glass 验 ASN 与路由,最后用连续多天晚高峰的监测画出真实质量基线。花半小时做这件事,能帮你避开绝大多数"用了一个月才发现线路烂"的坑。
延伸阅读
更多相关攻略推荐:美国 VPS 推荐 2026:从 $10/年起的便宜大碗机型横向评测、2026 VPS 选购决策树与白皮书:一张图看懂怎么买、2026 海外 VPS 行业趋势年报:价格、架构与格局全景、如何给 VPS 厂商做"信用评估":跑路、超售与售后风险排查手册、读者真实部署案例 Showcase:他们用廉价 VPS 搭了什么?。
一、为什么开箱第一件事是测网络
VPS 和普通家用电脑最大的不同,是它身在一张你无法直接控制的国际骨干网里。商家页面上写的"1Gbps 端口""CN2 优化线路",只是纸面承诺。真实体验取决于三段链路:你本地到机房的去程、机房回你本地的回程、以及中间若干运营商的互联节点。任何一段在晚高峰拥塞,你的网站就会白天飞快、晚上转圈。所以测网络不是可选项,而是验收环节,和验收到货的硬件一样重要。
另一个常被忽略的点是"对称性"。很多套餐上行(你发往外界)和下行(外界回你)并不对等,尤其是共享端口的预算机型。建站时用户从你的 VPS 拉数据走的是下行,你推备份到对象存储走的是上行,两边都要测。只看一边就下结论,很容易翻车。
还有几个最常见的坑,只有亲手测才踩得出来:带宽超售——标称 1Gbps 的端口晚高峰实测可能只剩两三成,因为整台宿主机在和邻居抢带宽;单向 CN2——去程走精品网、回程却绕回普通 163 骨干,你从国内访问的体验由回程决定,照样卡;机房选错——同商家不同机房路由天差地别,比如 RackNerd 圣何塞走 Cogent/GTT、新泽西回程走 PCCW/Level3,对电信、联通、移动三网表现各不相同。所以别只看套餐页,动手测才是硬道理。
二、ping:最便宜的延迟体检
iperf3 测带宽、mtr 测丢包,但第一道关是延迟。ping 用 ICMP 回显测往返时延(RTT),零成本、零依赖,是所有测试的起点。别只 ping 4 次——样本太少看不出抖动,建议至少 100 个包:
ping -c 100 -i 0.2 你的VPS_IP
ping -c 50 1.1.1.1重点看结尾那行汇总 rtt min/avg/max/mdev = 151.2/158.7/203.4/12.1 ms:
| 指标 | 含义 | 怎么算正常 |
|---|---|---|
| avg(平均延迟) | 数据包来回一趟的平均耗时 | 到美国 130~180ms 属正常,CN2 GIA 可压到 130~160ms |
| max(最大延迟) | 最慢的一次 | 比 avg 高出一大截说明有抖动或拥塞 |
| mdev(标准差) | 抖动程度 | 小于 5ms 极稳,大于 30ms 说明链路不稳 |
| packet loss | 丢包率 | 0% 理想,1% 以内可忍,超过 2% 要警惕 |
小技巧:ICMP 在有些机房会被限速或丢弃,ping 显示丢包未必是真丢,要结合下面 mtr 一起看。另外别只 ping 一个目标,建议同时测 1.1.1.1(Cloudflare)和 8.8.8.8(Google),对比一下就知道是不是某条出口的问题。
三、iperf3 打吞吐:上下游都别放过
若工具还没装,Debian/Ubuntu 上一条命令装齐:sudo apt install -y iperf3 mtr-tiny traceroute iputils-ping(CentOS / Rocky 用 sudo dnf install -y iperf3 mtr traceroute)。iperf3 默认端口 5201,记得在防火墙放行。装好后,iperf3 是测两点之间真实带宽的黄金工具。它分服务端和客户端:一端跑 iperf3 -s 监听,另一端当客户端连过去打流。默认端口是 5201,如果占用就加 -p 换一个。注意服务端要放行该端口的防火墙,否则客户端会报 connection refused。
最基础的单线程测试往往跑不满带宽,因为单条 TCP 流受窗口限制。想压出真实上限,用 -P 开多条并发,用 -t 拉长到 30 秒以上让链路稳定:
# 服务端(在另一台机器或本地)
iperf3 -s -p 5201
# 客户端:4 线程打 30 秒,测"你到 VPS"的上行
iperf3 -c 1.2.3.4 -p 5201 -t 30 -P 4
# 反向测试:测"VPS 到你"的下行
iperf3 -c 1.2.3.4 -p 5201 -R -t 30 -P 4输出里重点看两列。Bitrate 是实际吞吐,单看这一列就能判断带宽是否达标;Retr 是重传次数,数值越高说明链路越不稳,哪怕带宽数字好看,高重传也意味着实际传输会抖动、会掉速。想做 UDP 丢包与抖动评估,加 -u 并配合 -b 指定目标码率,重点看服务端的 Lost 与 Jitter。需要自动化就加 --json 输出,方便写脚本记录;长距离链路可调大 TCP 窗口 -w 2M 来提升效率;再用 -O 5 跳过开头的慢启动阶段,取稳定段数据更准。
实测经验:一台标称 1Gbps 端口的机器,去程(你到它)压到 900Mbps 以上算健康;但回程(它到你)受你本地宽带上行限制,普通家庭宽带可能只有几十 Mbps,这不一定是 VPS 的问题,要分清瓶颈在哪。跨机房对比时,用两台自有 VPS 互打最干净,能排除本地宽带的干扰。顺带一提,不少商家 LG 提供测试文件,可以用 wget 拉一个 100MB 文件,看实测下载速度是否稳在标称值附近,作为 iperf3 的交叉验证。
四、mtr 看每一跳:晚高峰才是照妖镜
iperf3 告诉你"能跑多快",mtr 告诉你"慢在哪里、丢在哪"。它把 ping 和 traceroute 合二为一,实时显示每一跳的丢包率与延迟。一次性出报告用:
# 报告模式,向目标发 100 个包后输出结果
mtr -r -c 100 8.8.8.8
# 只看 IP、不做域名反解,更快
mtr -n -r -c 100 目标IP
# 某些节点限 ICMP,用 TCP 443 模式穿透
mtr -n --tcp --port 443 目标域名
# 或 UDP 模式辅助观察
mtr -n --udp 目标IP输出列含义:Host 是每一跳的节点,Loss% 丢包率,Snt 发包数,Last/Avg/Best/Wrst 是最近、平均、最好、最差的延迟,StDev 是标准差,越大说明抖动越厉害。判读有个关键陷阱:某一跳显示 100% 丢包,但后面几跳又正常响应,这通常是该路由器对探测包做了限速或屏蔽 ICMP,并非真断——它仍在默默转发流量。真正的故障标志是:丢包从某一跳开始出现,并且一路持续到你的最终目标。这种"从头烂到尾"的模式,才说明问题出在那一跳及其之后的链路。
为什么强调晚高峰?白天骨干网空闲,几乎所有线路都漂亮;真正分流的是晚上 20:00 到 23:00。很多预算机型是共享端口,晚高峰一拥塞,mtr 里中间节点就开始出现零星丢包、延迟翻倍。所以体检一定要挑晚高峰跑,而且不要只跑一次——单次结果可能被临时绕路误导。需要一次性快照确认线路时,traceroute 也很好用:traceroute -T -p 80 目标IP 用 TCP 80 端口探测,比 ICMP 更贴近真实访问路径,也更容易看清 CN2 特征(Windows 用 tracert -d 目标IP)。
五、Looking Glass 验 ASN 与路由
iperf3 和 mtr 测的是"你到 VPS"这段,但要看清"VPS 回你"走的是哪条国际链路,得借助 Looking Glass(LG)。LG 是各家运营商提供的公开 Web 接口,能从他们某个机房节点向你的 IP 发起 ping、traceroute 和 BGP 查询。常用三类命令:BGP 显示 AS 路径与下一跳,PING 显示往返时延,TRACEROUTE 显示逐跳路径。比如 Gcore 的 lg.gcore.lu 就提供按大洲选节点、再对目标 IP 做三种探测。
对国内用户最有价值的是验回程路由:从商家节点 traceroute 到你的本地 IP,看沿途经过哪些 AS、是否走了宣称的 CN2 或优化线。如果页面声称 CN2 GIA,但 LG 显示回程绕到了普通 163 骨干或者欧美绕一圈,那就是货不对板。再配合 bgp.tools 这类工具查目标 IP 的归属 AS、前缀可见性与是否有被劫持的迹象,能交叉验证路由真实性。
更高明的做法是"买前先测":不少商家在售前就开放 LG。你先用 LG 从意向机房 ping 你的本地 IP、traceroute 到你的运营商,心里对延迟和路径有数,再决定是否下单,比买了才发现路线绕要省心得多。对 DMIT、HostDare 这类主打回国优化的商家,这一步尤其关键。
只凭路径还分不清真假 CN2?记住两个标志性网段:59.43.x.x 是中国电信 CN2 GIA 骨干(AS4809),路径里连续出现多个 59.43 节点基本可判定走精品网;202.97.x.x 是普通 163 骨干,晚高峰最容易堵,全程见不到 59.43、只有 202.97,多半不是真 CN2。各家 LG 入口举例:RackNerd 洛杉矶 lg-lax02.racknerd.com、圣何塞 lg-sj.racknerd.com、新泽西 lg-nj.racknerd.com、西雅图 lg-sea.racknerd.com 等;Vultr 直接给区域 ping 主机如洛杉矶 lax-us-ping.vultr.com、东京 hnd-jp-ping.vultr.com。图形化可用 ipip.net 的 BestTrace,自动标注每跳运营商与 AS 号;查 BGP 前缀归属用 bgp.he.net。
六、连续多天晚高峰,画出质量基线
单次体检只能算快照,连续监测才是基线。建议这样操作:连续 3 到 7 天的晚高峰时段(20:00–23:00),每天用同一台本地机器对 VPS 跑一次 mtr(-c 100)和一次 iperf3 反向测试,把延迟、丢包率、下行吞吐三个数记下来。几天样本一摊,你就能看出:平均延迟多少、晚高峰丢包是否规律性出现、带宽是否每天同时段掉档。这条曲线,就是这台机器的真实质量画像。
想更进一步,可以部署一个常驻的延迟监控。把 Uptime Kuma 这类轻量监控装在另一台机器上,对目标 VPS 做周期性 ping/HTTP 探测,自动画出 24 小时延迟曲线,连你睡觉时的波动都能抓到。一旦某天晚高峰延迟或丢包突破你设定的阈值,立刻收到提醒,不用等用户投诉。基线画好之后,你也就有了和商家工单交涉的客观证据:不是"感觉慢",而是"连续五天晚高峰丢包 8%、延迟从 30ms 飙到 180ms"的硬数据。
拿到一台新机器,先把上面几项指标汇总成一张速查表打分,照着判断即可:
| 维度 | 优秀 | 及格 | 翻车 |
|---|---|---|---|
| 到国内平均延迟 | <160ms(CN2 GIA) | 160~220ms | >250ms 且绕路 |
| 丢包率 | 0% | 1% 以内 | >2% |
| 抖动 mdev | <5ms | 5~15ms | >30ms |
| iperf3 实测带宽 | 接近标称 1Gbps | 标称的 50%~80% | 不足标称 30% |
| 回程路由 | 双向 CN2/直连 | 部分绕行 | 全程 163 绕美/日 |
没有一台机器能在所有维度拿满分,关键是看你的业务痛点:建站看重延迟和丢包,下载/中转看重带宽,游戏看重 UDP 抖动。按需求取舍即可。最后给个验收清单:iperf3 上下游都压过且 Retr 接近 0;mtr 晚高峰跑出无持续性丢包;LG 验回程路线与宣传一致(最好回程也出现 59.43);wget 测试文件速度稳在标称值附近;连续多天基线平稳。五项全过,这台 VPS 才算真正"体检合格",可以放心往上建站。任何一项不达标,趁着还在退款期尽早换机,比硬扛一年划算得多。
延伸阅读:想搞懂商家宣传的 CN2 到底意味着什么,看 什么是 CN2 GIA 线路;带宽超标与流量计费模式会影响你的实测预期,见 VPS 带宽与流量计费完全指南;想把连续监测自动化,参考 用 Uptime Kuma 给 VPS 做监控;更多基础设施深潜指南可前往 VPS 主题导读中心 (Hub)。