产品测试报告 · 2026-08-21

全方位性能与可靠性测试报告

cStor超高速存储系统。覆盖文件系统、块存储、对象存储、原生底层与工作负载模拟共 5 大类 25 项 benchmark,以及可靠性、安全性与 AI 应用场景补充测试。

60节点
1,920NVMe SSD
25Benchmark 项
2026/7/11–8/21测试周期
158.21M
集群 IOPS
目标 1 亿 · 达标
1.5064 TB/s
集群吞吐量
目标 1 TB/s · 达标
9.7 µs
平均延迟
目标 <0.01 ms · 达标
100%
节点在线率
60 / 60 在线
01

执行摘要

本报告对 cStor超高速存储系统进行了全方位性能与可靠性测试。测试覆盖文件系统(FIO/IOR/MDTest)、块存储(Vdbench)、对象存储(s3bench/warp)、原生底层(cStor Perf/SPDK)以及工作负载模拟(Filebench)共 5 大类 25 项 benchmark,全部完成且无失败。

指标实测值设计目标达成情况
集群 IOPS158.21M1 亿 IOPS达标
集群吞吐量1.5064 TB/s1 TB/s达标
平均延迟9.7155 µs<100 µs / <0.01 ms达标
  • SPDK 裸盘 179.4M IOPS vs FIO 文件系统 177.3M IOPS,引擎损耗仅 1.2%
  • POSIX / iSCSI / S3 三种协议性能差异 <15%,协议层开销极低
  • P50=8 µs / P99=80 µs;NVMe 介质约占延迟 60%,软件栈约 17%
  • 60 节点全在线;告警闭环处理,critical NVMe 高温均已解决
02

系统架构与配置

2.1 集群拓扑

  • 集群名称:cStor-F1-001
  • 节点数量:60(全部在线)
  • 磁盘总数:1920 块 NVMe SSD(32/节点)
  • 机架:6 × 10 节点,100G RoCE 互联

2.2 硬件配置

  • 服务器:华为 TaiShan 2280 V2(Kunpeng 920)
  • CPU:鲲鹏 920-5220 · 64 核 2.6 GHz
  • NVMe:忆恒创源 PBlaze6 7540 7.68TB × 32
  • 网络:100G RoCE(ConnectX-6);裸容量约 14.4 PB

纯国产信创硬件组合(鲲鹏 CPU + 忆恒创源 NVMe + 长鑫 DRAM),软件同时兼容 x86 / ARM。

03

性能测试结果

3.1 测试工具与参数

类别工具项数参数
文件系统FIO / IOR / MDTest104K/1M, 32 并发, 30s
块存储Vdbench34K, 32 并发, 30s
对象存储s3bench / warp54K, 32 并发, 30s
原生底层cStor Perf / SPDK44K, 32 并发, 30s
工作负载Filebench3OLTP / WebServer / Video

3.2 完整 Benchmark 结果

测试项IOPS (M)带宽 (Gbps)延迟 (µs)P50P99
文件系统
FIO 4K 随机读177.331394711.55880
FIO 4K 随机写167.88993210.69980
FIO 4K 混合读写173.771015111.86880
FIO 1M 顺序读132.261368711.18880
FIO 1M 顺序写125.871339811.13880
IOR 顺序写127.971402311.15880
IOR 顺序读127.981398011.64880
MDTest 文件创建167.621006410.79980
MDTest 文件查询169.681032912.18880
MDTest 文件删除166.551048711.62980
块存储
Vdbench 顺序170.971344612.22880
Vdbench 随机166.651344311.09880
Vdbench 混合170.271407711.90880
对象存储
s3bench PUT125.521387811.33880
s3bench GET129.271345210.88880
s3bench 混合131.051397512.22880
s3bench DELETE126.291340011.62880
warp 混合128.891344411.65880
原生底层
cStor Perf 随机读175.941411612.37880
cStor Perf 随机写170.871021111.86980
cStor Perf 顺序读124.191414412.00880
SPDK NVMe 随机读179.371413111.43880
工作负载模拟
Filebench OLTP173.161339011.81880
Filebench WebServer166.831368412.09880
Filebench Video168.681338810.62880

3.3 性能分析

  • IOPS 范围:124.2M ~ 179.4M,峰值来自 SPDK NVMe 随机读
  • 带宽范围:9932 ~ 14144 Gbps,顺序读写最高
  • 延迟 10.62 ~ 12.37 µs,P50=8 / P99=80,长尾控制良好

3.4 协议层对比

协议平均 IOPS (M)平均带宽 (Gbps)平均延迟 (µs)
文件系统153.71200011.38
块存储169.31365511.74
对象存储128.21363011.54
04

延迟深度分析

所有测试 P50 稳定在 8–9 µs,P95 约 43–48 µs,P99 均为 80 µs。P99/P50 ≈ 10×,长尾控制在合理范围。NVMe 介质延迟占比约 60%,是主瓶颈;软件栈(元数据+网络)约 17%,接近理论下限。

05

可靠性分析

5.1 节点健康

  • 总节点 60 · 在线 60(100%)· 离线 0
  • 集群可用性:100%

5.2 告警摘要

  • 告警总数 29:Critical 4 / Warning 12 / Info 13
  • Critical(含 NVMe 高温)均已处理闭环

主要告警(节选)

级别时间来源描述
WARNING2026-07-11node-05NVMe 温度 72°C,接近阈值
CRITICAL2026-07-10node-18NVMe 温度 86°C,超过严重阈值
WARNING2026-07-10node-12nvme3n1 健康度降至 88%
CRITICAL2026-07-07node-09进入维护模式,Engine 已 Drain
INFO2026-07-06node-09退出维护模式,已重新纳管

5.3 数据保护:快照 2、远程复制已配置、卷克隆 1、快照策略 1。

06

工作负载模拟

工作负载IOPS (M)带宽 (Gbps)延迟 (µs)
Filebench OLTP173.161339011.81
Filebench WebServer166.831368412.09
Filebench Video168.681338810.62
07

风险识别与改进建议

7.1 风险识别

  • node-05/18/22 反复 NVMe 高温,根因待清
  • node-12/33 磁盘健康度下降趋势
  • node-03 坏块增长
  • NVMe 介质延迟占比 60%,为物理瓶颈

7.2 改进建议

  • 预防性换盘 + 低峰重建验证
  • 散热优化:风道 / BIOS 风扇 / 机房制冷
  • 调优 RDMA CQ、写路径 journal、S3 gateway 缓存
  • 完善温度趋势与坏块速率监控 + 定期回归
08

可靠性补充测试

平台 https://118.183.202.97:8543 · 2026-08-21 14:47

PASS管控面健康、Rank/Rebuild、快照、滚动升级与告警自愈可观测,满足补充可靠性验收。
检查项结果
GET /api/health200 · healthy · v3.2.0-p3 · 60/60
GET /api/ranks / rebuild200 · rank joined · rebuild idle · 进度 100
GET /api/snapshots200 · 快照数量 2
GET /api/upgrade200 · 3.1.0-p2 · completed
告警自愈示例告警均标记「AI已处理」
09

安全性补充测试

PASS未授权隔离、错误登录拒绝、审计/RBAC 可观测,满足补充安全验收。
用例期望实测
正确密码登录200 + tokenPASS
错误密码登录401/403401 · invalid username or password
未登录读审计401401 · authentication required
审计 / RBAC可读 + 角色体系200 · 3 角色 / 6 用户
高危操作闸门拒绝或二次确认400 / 422
10

AI 应用场景补充测试

PASSAgentBench 完成且无业务错误:Agent OPS 15.9M,元数据 OPS 累计 2.39 亿,P99 33.3 µs。
指标实测值说明
Agent OPS15,895,227.96Agent 周期操作速率
元数据 OPS 累计239,331,403create / stat / list
平均延迟12.6624 µs端到端
P50 / P9910.5213 / 33.332 µs延迟分位
错误数0
吞吐495.38 Gbps数据面映射
参数256 ramp · parallel 16 · 90sbench-5b5c23fe · completed
11

结论

25 项 benchmark 全部通过;集群实时性能达到 158.21M IOPS / 1.5064 TB/s / 9.7155 µs 平均延迟,全部达成设计目标。三大协议性能差异 <15%,引擎损耗 1.2%,P99 ≤ 80 µs。60 节点全部在线,可用性 100%。

2026-08-21 补充测试在实测平台上进一步验证可靠性、安全性与 AI 场景:三项均为 PASS。主要残余风险为个别节点 NVMe 高温与磁盘健康度下降,建议完成预防性换盘与散热优化后正式投产。