2026年VPS基准测试指南:购买前如何实测性能
用 Geekbench、fio、iperf3 和 YABS 实测 VPS 性能,结合 ServerVerify 一万份基准数据的经验,识别虚标商家、买前把好关。
2026 年 8 月,一个由社区驱动的基准测试项目跨过了具有标志意义的门槛。ServerVerify 自 2025 年 9 月 15 日上线以来,累计收到超过 10000 份基准测试结果和 1600 条审核通过的评测。创始人 Jon Biloh 在主机行业干了 20 年,2006 年创办了 ColoCrossing。他在 LowEndBox 的专访里说得很直白:数字本身不重要,重要的是每一条结果在公开前都经过人工审核,确认数据真实、服务商归属准确。
这个项目存在的理由,每个买过 VPS 的人都懂。服务商公布配置、价格、网络参数,但没有一条告诉你服务器实际用起来什么感觉。纸面参数很漂亮的机器,跑起来可能很拉胯;名不见经传的小商家,反而可能闷声给足性能。广告和现实之间的差距,就是基准测试存在的意义。
这篇指南讲的就是怎么填上这个差距:哪些测试值得跑、怎么跑才不骗自己、2026 年真实的数字大概是什么水平、以及怎么用结果而不是宣传来选主机。
为什么参数表会骗人
每份 VPS 配置单都长一个样:vCPU 数量、内存、硬盘类型、端口速率、价格。这五样里没有一样是承诺。
vCPU 不等于物理核心
大多数廉价 VPS 的 CPU 是跟邻居共享的。"4 vCPU"可能是安静节点上的四个专属线程,也可能是超售节点上被限速的一小块。标签一样,体验天差地别。
超售是常态,超售过头才是问题
服务商卖出的资源常常超过硬件实际拥有的。这个模式在邻居都睡觉时没问题,一旦有个重度用户落到你的节点上,你的"4 核"可能连 1.5 核的性能都跑不出来。年付低价套餐是最容易踩坑的地方。
"SSD"这一个词能差出 50 倍
SSD 三个字母,涵盖 NVMe、SATA 固态,甚至带缓存的机械盘。同样的标签,随机读写性能差几十倍。一条随机读测试十秒钟就能把它们分开。
爆发性能与持续性能
有些套餐会在基准测试的前 30 秒给你 100% CPU,然后立刻限速。配置单上永远不会写这个限速。只有持续负载测试能抓住它。
端口速率是管道,不是承诺
"10Gbps 端口"描述的是连接,不是你实际分到的带宽。50 个人共享的 10Gbps 可能还不如一条独享 1Gbps。带宽宣传需要和 CPU 宣传一样的怀疑态度。
一台 VPS 可以在纸面上看起来非常出色、实际用起来却很糟糕,而一个规模更小或名气不大的服务商可以悄悄提供出色的性能。- Jon Biloh,ServerVerify 专访,2026 年 8 月
10000 份基准数据告诉了我们什么
ServerVerify 值得了解,因为它算得上行业里最接近"共享标准化性能数据"的东西。上线十个月,数据库里有 10000 多份基准和 1600 条审核通过的评测,每一条提交都经过人工检查,确认数据完整、服务商归属准确。
最意外的数据:大多数用户其实是满意的
提交基准的 VPS 和独立服务器用户中,平均推荐率超过 80%。也就是说每五个用户里有四个愿意推荐自己的服务商。Biloh 说这个数字比他预想的高。人们抱怨时嗓门总是比表扬时大,所以一份靠用户自愿提交的数据集居然偏正面,确实出人意料。
平台现在能做什么
- 高级基准搜索和筛选,包括 FIO 存储性能筛选和按国家/地区筛选
- 服务商主页,含用户评测、性能趋势、推荐率随时间的变化
- 性价比排名和"最受推荐服务商"榜单
- Insights 板块,把基准数字和评测、市场份额、趋势结合起来看
下一步
路线图上有服务商对比工具、原生基准测试脚本、GPU 基准支持,以及为 Geekbench 7 做准备。目前平台依赖外部基准源,所以原生脚本很关键:能更严格控制测试流程,拿到更统一的数据。
对买家来说结论很简单:社区数据比广告可靠,但前提是数据标准化、经过审核。这正是你自己下单前应该在机器上做的事。
CPU 怎么测:Geekbench 6 与 sysbench
CPU 性能决定网站、数据库、游戏服务器和构建管线的体验。三件工具就够了。
Geekbench 6:可对比的标准
Geekbench 6 是目前最可比的 CPU 基准。CLI 版本本地免费运行,装好后执行二进制,会给出单核和多核分数,可以直接跟公开结果对照。
- 单核分数决定大多数真实负载:PHP 和 Node 请求处理、SQL 查询、游戏服务器 tick、SSH 响应
- 多核分数决定编译、视频编码、数据处理这类并行任务
- 两个分数都要记,还要记下 Geekbench 大版本号,不同大版本的分数不能直接比
sysbench:哪都有,秒装
sysbench 在各大发行版仓库里都有,sysbench cpu --threads=N run 输出每秒事件数,是通用的快速体检工具。
openssl speed:加密性能别忽略
如果机器要终止 TLS,跑一下 openssl speed -multi 4 aes-256-gcm。它测加密吞吐,顺带确认 AES-NI 硬件加速是否启用。开不开 AES-NI,差距经常是几倍而不是几个百分点。
盯住持续表现
单次快测会放过限速型主机。让 CPU 满载跑 15 分钟以上,盯着负载均值。如果第一分钟分数漂亮、十分钟后掉了 40%,你学到的比任何 headline 数字都多。
硬盘怎么测:fio 才是唯一标准
存储是廉价 VPS 和配置单差距最大的部分。要测就测对。
dd 只能算粗看
dd if=/dev/zero of=test bs=1M count=2048 oflag=direct 只测顺序写速度,结果还受缓存影响,完全反映不了数据库和包管理器真正产生的随机 I/O。dd 用来第一眼扫一下可以,当结论不行。
fio 是行业标准
fio 是主机圈公认的磁盘基准。三个任务覆盖实用场景:
- 随机 4K 读:
fio --name=randread --rw=randread --bs=4k --iodepth=32 --size=1G --runtime=60 - 随机 4K 写:同样的任务,参数换成
--rw=randwrite - 顺序读:
fio --name=seqread --rw=read --bs=1m --size=2G --runtime=60
2026 年数字大概是什么水平
- NVMe,4K QD32 随机读:大约 300-800 MB/s,顺序读 1500-7000 MB/s
- SATA 固态,同样测试:随机 100-400 MB/s,顺序 500-560 MB/s
- 机械盘:随机不到 5 MB/s,顺序顶多 150-250 MB/s
如果服务商宣传 NVMe,fio 却跑出 SATA 级的随机读,那一定有问题:要么存储不是宣传的那个,要么节点超售严重。无论哪种,你都在付款前拿到了答案。
fio 跑两遍,挑一个低峰时段。共享存储上,邻居影响每一个数字。
网络怎么测:iperf3 与"10Gbps"陷阱
网络参数最需要怀疑,因为端口是共享的,而营销最爱大数字。
iperf3:吞吐测试
iperf3 需要两端。用公共 iperf 服务器,或者自己再开一台 VPS 做对端。iperf3 -c <server> -P 4 -t 30 测下行,加 -R 测上行。1Gbps 端口单流上限大约 940 Mbps,这是真实天花板,不是故障。
位置决定一半结果
测同机房服务器的吞吐,说明不了到你用户那里的路由。往你受众所在的区域测。配合 ping 和 mtr:同区域延迟 5ms 以内、跨洲 100ms 以内都算正常,持续丢包超过 0.5% 就是问题。对 SSH、API、游戏来说,这两个指标比原始带宽更重要。
"不限流量"要读小字
下列 2026 年 8 月优惠示例均为限时历史促销;下单前请在服务商结账页核验实时价格、优惠码资格和流量政策。验证方法很简单:往几个区域跑 iperf3,跟宣传对照。端口速率只是上限,不是保证。
一键脚本:YABS 与 bench.sh
手动跑五个工具太繁琐,社区做了打包脚本。
YABS:LowEndTalk 默认标准
Yet Another Bench Script 是 LowEndTalk 上的默认选择。它跑 Geekbench 6 单核多核、覆盖 4K/64K/512K/1M 块大小的 fio 套件、对多个位置的 iperf3 测试,最后输出一份干净的报告。标准用法是 curl -sL yabs.sh | bash,但先下载读一遍脚本再说。永远不要把不明脚本直接管道给 root。
bench.sh:要快就选它
bench.sh 更轻更快,不依赖 Geekbench。适合快速看磁盘和网络,CPU 对比能力弱一些。
社区数据库路线
这就是 ServerVerify 的位置。与其各跑各的脚本,不如把结果送进共享的、人工审核的数据库,让法兰克福的 Ryzen 节点和洛杉矶的 EPYC 节点可以被任何人直接对比。一万份基准,正是这些对比开始有意义的量级。
专业的测法:方法比工具重要
工具不如纪律重要。随便跑出来的基准,只是带步骤的广告。
- 在新系统上测。部署业务前,先在干净的 Debian 或 Ubuntu 上跑基准,别让后面的环境弄脏数字。
- 不同时段多跑几次。一次是快照,不是结论。分数在不同时段波动超过 20-30%,说明节点噪音大或超售。
- 工具和参数保持一致。只有同样方式产出的结果才能比:同样的 Geekbench 版本、同样的 fio 任务文件、同样的 iperf3 参数。
- 测持续负载,不只测峰值。满载 15-60 分钟盯着负载均值,能抓住 60 秒测试发现不了的限速。
- 往用户所在的区域测,别往机房自己的测速服务器测。
- 给它一周时间。基准是预测,真实负载才是裁判。一周的在线率、磁盘 I/O、负载历史,比任何单次测试都有说服力。
2026 年合格数字长什么样
以下是大致范围,不是承诺,因为每个节点都不一样。用来对照结果是否合理。
Geekbench 6 单核参考
- 现代桌面级芯片,如 Ryzen 9 9950X 或 i9-14900K:大约 2900-3300
- 服务器级 EPYC 7003 系列(比如 2026 年廉价主机常用的 EPYC 75F3):大约 2000-2300
- 老款 Xeon,如廉价独立服务器上的 E5-2698 v4:大约 900-1100
- 共享 vCPU 的廉价 VPS:600-1500 之间,很大程度取决于邻居
多核分数随线程数增长。现代 EPYC 上的 4 vCPU 机器,多核应该接近单核的四倍;如果差得远,说明核心是共享的或者节点超售。
磁盘和网络底线
- fio 4K QD32 随机读:NVMe 300-800 MB/s,SATA 固态 100-400 MB/s,机械盘不到 5 MB/s
- iperf3 单流:1Gbps 端口 900+ Mbps,共享 10Gbps 多流 2-9 Gbps 都现实
还有一条提醒:好得离谱的结果,要用非常规负载复核一次,比如现场编译点什么,或者狠压一把数据库。会针对基准流量做优化的主机,过不了这一关。
真实价格与真实预期
基准只有放在价格旁边才有意义。当前 LowEndTalk 的优惠流,就是 2026 年 8 月真金白银能买到什么的活样本。
年付预算档,25 美元以内
- TrumVPS 越南 KVM,优惠码 LOWEND20 后 $14.80/年
- NolimitHost NVMe KVM,约 €12.99/年起
- SVR4U 马来西亚 Intel KVM,$20/年,含 IPv4 和 /64 IPv6
- DeluxHost NVMe 产品线,约 €6/年起
月付预算档,2-5 美元
- DataPasa 1GB KVM,$1.79/月起,优惠码 LET10
- Godlike.host $2/月起,EPYC 75F3 上大约 1 美元 1GB 内存,优惠码 LEB50
- 1337 Hosting 法兰克福 Ryzen 9950X KVM,$4.34/月起,25Gbps 加反应式 DDoS 过滤
- CloudBlast 4GB,€4.03/月,覆盖美国、荷兰、香港
大内存与独立服务器
- Host Mayo 堪萨斯:16GB 内存、8 核、200GB SSD、20TB 流量 @10Gbps,$10/月
- LayerOne 坦帕 KVM,SAS SSD 含 DDoS 防护,$17.99/年起
- ColoCrossing 独立服务器,洛杉矶和布法罗,$25/月起
- MEVSPACE 双路 Xeon E5-2698 v4、128GB 内存,€99/月
按档位诚实看待。$15/年的机器和 $15/月的机器跑分必然不同,这很正常。真正的本事是在同一价位里找到跑分最好的那个,这正是 ServerVerify 这类共享数据的用途。生产环境别只按价格选:给前两名各跑一周,用证据而不是形容词做决定。
最终检查清单
- Geekbench 6 单核、多核各跑至少两次,选不同日期
- fio 随机 4K 加顺序测试,跟宣传的存储类型对照
- iperf3 双向测试,目标选用户所在区域
- CPU 满载 15 分钟以上,观察是否限速
- ping 和 mtr 检查延迟与丢包
- 真实业务负载跑满一周再下结论
- 同一服务商,用社区数据交叉验证
配置是承诺,基准是证据。行业正在慢慢积累共享的诚实数据,ServerVerify 的一万份结果就是其中一部分。但任何数据库都替代不了你自己跑一遍。测两次,买一次,收好记录。