Mstor AI 原生并行存储

全国产化高性能 AI 存储,大模型训练 GPU 等待时间缩短 70%+|支持单机部署|性能损耗10%,将磁盘作为kv cache的延伸,极大降低显存带宽的需求

面向 AI 时代的全国产化并行存储

Mstor 是一款全国产化高性能 AI 原生并行存储解决方案,面向 AI 训练推理、高性能计算(HPC)、金融大数据分析、生命科学等多场景,支持云、容器及大数据环境的统一存储。

全对称架构实现元数据+数据全打散,系统容量与性能线性扩展无任何瓶颈;多协议融合(POSIX/NFS/SMB/S3/HDFS/CSI),一套系统满足多种业务需求。

  • 自主可控,国产化品牌,无开源及国外产品后门风险
  • 灵活扩展:容量与性能可横向扩展
  • 端到端数据可靠性与访问控制
  • 支持 Kubernetes、MinIO、AWS、腾讯云、阿里云快速部署
GPFS 并行存储性能指标

核心功能特性

从数据加速到多租户管理,覆盖企业级存储全场景需求

SSD/NVMe 性能加速

利用少量 SSD/NVMe 对文件系统进行 IO 加速,大幅提升 IOPS,随机 1K 读可达 111 万+ IOPS。

🌐

全局统一命名空间

全对称架构,元数据+数据全打散,系统容量+性能线性扩展无任何瓶颈。

🔗

多协议融合

支持 POSIX/NFS/SMB/S3/HDFS/CSI 多协议共同访问,文件与对象存储互通,零拷贝多样性处理。

📊

分级存储 & QoS

分级存储架构降低 TCO,多租户 QoS 管理满足企业分级资源与性能隔离需求。

📸

快照 & 数据保护

文件系统快照防止误操作、病毒导致数据丢失;多副本冗余 + 纠删码 N+M 保护。

🔐

权限管理 & 配额

ACL/用户组灵活授权,支持 AD/LDAP 整合,子树管理精细化权限与配额控制。

🩺

磁盘医生

主动磁盘健康度检测,亚健康状态分析,硬件故障自动隔离,系统自动重构数据冗余策略。

⚖️

负载均衡 & 一致性

智能分配客户端请求避免热点,实时读写一致性校验防止静默数据错误。

大模型训练加速,GPU 等待缩短 70%+

相比传统 NFS 方案,Mstor 让训练过程中 GPU 等待时间大幅减少

70%+

Shuffle + Read 访问效率提升

4x

小文件延时和 QPS 提升

2-3x

Checkpoint 耗时降低

关键技术优势

🔹 分布式锁管理(SLM)

子区块粒度最小化并发冲突,N 对 1/N 对 N 均衡请求,优化持续顺序多写、强制落盘等多种 IO 模型。

🔹 海量元数据处理优化

分布式元数据管理避免瓶颈,强一致性日志独立管理,百亿小文件下操作/读/写性能无衰减。

🔹 可变数据块弹性管理

子块最小控制 4K 粒度优化小 IO,N 个 block 合成优化大文件带宽,自动适应 AI/HPC 多阶段场景。

🔹 深宽目录结构优化

哈希优化快速获取扁平结构路径,千万级文件目录地址一次性预读加载,并发 4000 节点瞬时创建秒级完成。

实测性能数据

真实场景验证,性能远超传统方案

IOPS 性能测试

随机 1K 读 IOPS 1,117,172
随机 1K 写 IOPS 361,984

场景:某生物研究所 DNA 小文件拷贝(7.7TB / 2000 万文件 / 100-200K)

拷贝时间仅 11 分 41 秒

EDA 编译对比

Mstor 编译耗时 23 分钟
A 厂商 1 小时 20 分
B 厂商 4 小时

场景:某芯片公司 VC 编译同一芯片模型

编译效率提升 3-10 倍

典型应用场景

从 AI 训练到芯片仿真,覆盖多行业核心业务

🧠

AI 训练与推理

支持千卡/万卡 GPU 集群高并发数据访问,Checkpoint 秒级写入,大模型训练效率显著提升。

  • 🔹 千卡集群 1024-2048 卡并发支持
  • 🔹 全闪池/混闪池分层架构
  • 🔹 NFS-CSI 对接 Kubernetes
💻

高性能计算(HPC)

TB 级聚合带宽,RDMA 高速网络,满足科学计算、仿真分析等超高吞吐需求。

  • 🔹 单文件/对象读写 GB/s 级带宽
  • 🔹 Infiniband/RoCE RDMA 支持
  • 🔹 MPI 生态兼容 OpenMPI/MPICH
🏥

医疗 PACS 影像

全国产化替代国外存储,PACS 场景性能优于竞品 2 倍,支持麒麟/欧拉国产操作系统。

  • 🔹 SMB-PACS 拷贝速度 1.4-1.6GB/s
  • 🔹 数据处理速度提升 200%
  • 🔹 统一纳管新老存储设备
🔬

芯片 EDA 仿真

编译效率比竞品提升 2.5-10 倍,三副本高可靠,支持 66+ 客户端并发设计仿真。

  • 🔹 编译阶段效率提升 2.5 倍
  • 🔹 三副本长周期高可靠
  • 🔹 统一数据平台消除孤岛
🧬

生命科学与生物医药

海量基因组数据分析,DNA 小文件高效处理,支持科研多课题并发与数据隔离。

  • 🔹 2000 万文件 11 分钟拷贝
  • 🔹 多课题配额与 QoS 隔离
  • 🔹 国产化保障数据安全
🏦

金融大数据分析

多租户隔离、高吞吐低延迟,满足金融级数据安全与合规要求,自主可控无后门。

  • 🔹 多租户权限与 QoS 隔离
  • 🔹 端到端数据加密保护
  • 🔹 国产化自主可控

落地案例

已服务算力平台、运营商、科研院所、医院等多个行业

北京某算力租赁平台 · 一期+二期

支持 128→256 台 8 卡 GPU 服务器(共 2048 卡)高并发访问,全闪 384TB+1106TB、混闪 1152TB+5PB 分层架构。

2475K
全闪 4K 随机读 IOPS
176 GiB/s
全闪 4M 顺序读吞吐
上海某通信运营商

128 台 8 卡 GPU 服务器,全闪 553TB + 混闪 1.6PB,RDMA 场景下全闪 IOPS 达 1310K,吞吐 66G。

1310K
全闪集群 IOPS
66 GiB/s
集群吞吐量
上海某科技公司智算中心

220 台服务器 1760 块 GPU,22 节点 3.2PB 并行存储,计算效率提升 30%,交付近一年零宕机。

国家电网某院某所

电力 AI 大模型课题,相同硬件环境下 Mstor 吞吐量达 CEPH 的 3-9 倍,多文件顺序写性能提升 9.3 倍。