Mstor AI 原生并行存储
全国产化高性能 AI 存储,大模型训练 GPU 等待时间缩短 70%+|支持单机部署|性能损耗10%,将磁盘作为kv cache的延伸,极大降低显存带宽的需求
面向 AI 时代的全国产化并行存储
Mstor 是一款全国产化高性能 AI 原生并行存储解决方案,面向 AI 训练推理、高性能计算(HPC)、金融大数据分析、生命科学等多场景,支持云、容器及大数据环境的统一存储。
全对称架构实现元数据+数据全打散,系统容量与性能线性扩展无任何瓶颈;多协议融合(POSIX/NFS/SMB/S3/HDFS/CSI),一套系统满足多种业务需求。
- 自主可控,国产化品牌,无开源及国外产品后门风险
- 灵活扩展:容量与性能可横向扩展
- 端到端数据可靠性与访问控制
- 支持 Kubernetes、MinIO、AWS、腾讯云、阿里云快速部署
核心功能特性
从数据加速到多租户管理,覆盖企业级存储全场景需求
SSD/NVMe 性能加速
利用少量 SSD/NVMe 对文件系统进行 IO 加速,大幅提升 IOPS,随机 1K 读可达 111 万+ IOPS。
全局统一命名空间
全对称架构,元数据+数据全打散,系统容量+性能线性扩展无任何瓶颈。
多协议融合
支持 POSIX/NFS/SMB/S3/HDFS/CSI 多协议共同访问,文件与对象存储互通,零拷贝多样性处理。
分级存储 & QoS
分级存储架构降低 TCO,多租户 QoS 管理满足企业分级资源与性能隔离需求。
快照 & 数据保护
文件系统快照防止误操作、病毒导致数据丢失;多副本冗余 + 纠删码 N+M 保护。
权限管理 & 配额
ACL/用户组灵活授权,支持 AD/LDAP 整合,子树管理精细化权限与配额控制。
磁盘医生
主动磁盘健康度检测,亚健康状态分析,硬件故障自动隔离,系统自动重构数据冗余策略。
负载均衡 & 一致性
智能分配客户端请求避免热点,实时读写一致性校验防止静默数据错误。
大模型训练加速,GPU 等待缩短 70%+
相比传统 NFS 方案,Mstor 让训练过程中 GPU 等待时间大幅减少
Shuffle + Read 访问效率提升
小文件延时和 QPS 提升
Checkpoint 耗时降低
关键技术优势
🔹 分布式锁管理(SLM)
子区块粒度最小化并发冲突,N 对 1/N 对 N 均衡请求,优化持续顺序多写、强制落盘等多种 IO 模型。
🔹 海量元数据处理优化
分布式元数据管理避免瓶颈,强一致性日志独立管理,百亿小文件下操作/读/写性能无衰减。
🔹 可变数据块弹性管理
子块最小控制 4K 粒度优化小 IO,N 个 block 合成优化大文件带宽,自动适应 AI/HPC 多阶段场景。
🔹 深宽目录结构优化
哈希优化快速获取扁平结构路径,千万级文件目录地址一次性预读加载,并发 4000 节点瞬时创建秒级完成。
实测性能数据
真实场景验证,性能远超传统方案
IOPS 性能测试
场景:某生物研究所 DNA 小文件拷贝(7.7TB / 2000 万文件 / 100-200K)
拷贝时间仅 11 分 41 秒
EDA 编译对比
场景:某芯片公司 VC 编译同一芯片模型
编译效率提升 3-10 倍
典型应用场景
从 AI 训练到芯片仿真,覆盖多行业核心业务
AI 训练与推理
支持千卡/万卡 GPU 集群高并发数据访问,Checkpoint 秒级写入,大模型训练效率显著提升。
- 🔹 千卡集群 1024-2048 卡并发支持
- 🔹 全闪池/混闪池分层架构
- 🔹 NFS-CSI 对接 Kubernetes
高性能计算(HPC)
TB 级聚合带宽,RDMA 高速网络,满足科学计算、仿真分析等超高吞吐需求。
- 🔹 单文件/对象读写 GB/s 级带宽
- 🔹 Infiniband/RoCE RDMA 支持
- 🔹 MPI 生态兼容 OpenMPI/MPICH
医疗 PACS 影像
全国产化替代国外存储,PACS 场景性能优于竞品 2 倍,支持麒麟/欧拉国产操作系统。
- 🔹 SMB-PACS 拷贝速度 1.4-1.6GB/s
- 🔹 数据处理速度提升 200%
- 🔹 统一纳管新老存储设备
芯片 EDA 仿真
编译效率比竞品提升 2.5-10 倍,三副本高可靠,支持 66+ 客户端并发设计仿真。
- 🔹 编译阶段效率提升 2.5 倍
- 🔹 三副本长周期高可靠
- 🔹 统一数据平台消除孤岛
生命科学与生物医药
海量基因组数据分析,DNA 小文件高效处理,支持科研多课题并发与数据隔离。
- 🔹 2000 万文件 11 分钟拷贝
- 🔹 多课题配额与 QoS 隔离
- 🔹 国产化保障数据安全
金融大数据分析
多租户隔离、高吞吐低延迟,满足金融级数据安全与合规要求,自主可控无后门。
- 🔹 多租户权限与 QoS 隔离
- 🔹 端到端数据加密保护
- 🔹 国产化自主可控
落地案例
已服务算力平台、运营商、科研院所、医院等多个行业
支持 128→256 台 8 卡 GPU 服务器(共 2048 卡)高并发访问,全闪 384TB+1106TB、混闪 1152TB+5PB 分层架构。
128 台 8 卡 GPU 服务器,全闪 553TB + 混闪 1.6PB,RDMA 场景下全闪 IOPS 达 1310K,吞吐 66G。
220 台服务器 1760 块 GPU,22 节点 3.2PB 并行存储,计算效率提升 30%,交付近一年零宕机。
电力 AI 大模型课题,相同硬件环境下 Mstor 吞吐量达 CEPH 的 3-9 倍,多文件顺序写性能提升 9.3 倍。