五项双第一背后:一场穿越十年的存储自研长跑

来源:互联网 时间:2026-09-03

近日,国际权威AI基准评测组织MLCommons公布MLPerf® Storage V3.0最新测试结果:浪潮数据AI存储AS13000G7参选六项核心测试,斩获五项第一,包揽多项单节点和单U性能双第一,全面覆盖大模型训练、大模型推理、HPC高性能计算三大核心场景。

数字之外,还有一段关于"没有捷径"的故事。

算力是矛,存力是盾

AI产业的舆论场,永远不缺光鲜的故事:大模型参数不断刷新纪录,GPU新品轮番登场,聚光灯牢牢锁在算力层。很少有人追问一个朴素的问题——花大价钱采购来的算力,如何避免白白浪费?

一个行业共识正在形成:算力是矛,存力是盾;算力决定上限,存力决定算力能不能真正落地变现。

把AI系统比作一座工厂,GPU就是高速运转的机床,存储则是原料仓库与中转站。仓库存取物料的速度跟不上机床节奏,再顶尖的机床也只能停工等待。对于政府、科研、医疗这类走不得冒险路线的政企客户,这一逻辑尤为现实:大模型训练中途存储拖后腿,Checkpoint断点保存失效,数十张GPU连续数周的训练成果可能付诸东流;面向公众的推理服务,存储时延抖动会直接转化为用户可感知的卡顿;医学影像、生命科学等科研任务,海量CT数据读取卡顿,研究周期被迫拉长。

正是真实业务的痛点,倒逼行业重新审视存储的价值,也让MLPerf® Storage这套国际基准评测成为智算、超算中心存储选型的核心标尺。该评测由图灵奖得主大卫·帕特森联合斯坦福大学、谷歌等机构发起,坚持架构中立、场景真实、结果可复现。全新升级的V3.0版本吸引全球19家厂商参与,规则大幅收紧:摒弃单轮最优成绩机制,强制多轮循环加压,新增KVCache推理负载,引入性能波动约束与跨节点一致性校验——专门过滤掉依靠临时调优拿到的"表演式成绩"。

通俗讲,旧版本考试可以选发挥最好的一次答卷计分,新版本要求连续反复考试,全程稳定才算合格。这恰恰戳中政企客户最核心的诉求:瞬时峰值再高没有意义,持续稳定输出才是硬通货。

在这场全球严苛的大考中,浪潮数据AS13000G7作为为数不多的国产代表,交出了参选六项、斩获五项单节点/单U性能第一的硬核成绩单。

五项双第一,长什么样

本次测试精准覆盖AI与高性能计算产业的三大核心存储需求:

* Checkpointing(大模型训练):checkpoint读写效率直接决定长周期训练的稳定性与模型迭代效率。AS13000G7在Llama3.1-70B模型负载下,单节点读带宽269.96 GiB/s,写带宽195.87 GiB/s,拿下单节点、单U读写带宽双项第一。

* KVCache(大模型推理):对应缓存卸载场景。Llama3.1-8B全落盘模式单节点吞吐达14,579 tok/s,为第二名的1.7倍;混合内存模式单节点吞吐达10,181 tok/s,为第二名的1.5倍。在KVCache 8B/70B全模型、全模式测试中均拿下三项单节点和单U性能双第一,实现"全模式包揽"。

* UNet3D(高性能计算):对应医学影像三维分析场景。基于KiTS19肾脏肿瘤CT数据集的高并发顺序读测试,单节点读带宽达268.86 GiB/s,性能为第二名的1.5倍,位列第一。

单节点、单U两个维度同时登顶,对政企客户具备双重现实价值:单节点第一,意味着单机拥有极致性能,集群可以灵活横向扩展;单U第一,则代表极高的性能密度——很多政企机房空间紧张、预算有限,更高的单位空间性能,直接节约机房占地,压低长期电力与运维的TCO,适配政府、医院、科研院所的多元建设条件。

很多人第一眼看到榜单,习惯把成绩归功于高端SSD硬件堆叠。但这次测试带来一个极具价值的行业启示:硬件划定性能的天花板,软件架构决定你究竟能不能摸到这个天花板。没有匹配的存储操作系统做调度,再强悍的NVMe SSD,潜力也会被软件链路的开销白白消耗。国产存储产业走到今天,比拼早已不是硬件采购整合能力,而是底层架构、数据操作系统等基础软件的全栈能力。

这份底气从何而来?答案要从十年前说起。

没有捷径的十年

2016年,国内分布式存储赛道刚刚起跑。和国内绝大多数同行一样,浪潮数据的起步选择了"捷径":站在成熟开源项目的肩膀上做改造,叠加定制化功能,快速拿下项目、交付客户,顺利完成商业化从0到1,支撑起一大批国内数智化项目落地。

但这就像接手一套二手房:研发团队可以刷墙、换家具、改造软装,却动不得房子的承重墙。客户真实的企业级高性能诉求,与开源社区的迭代节奏,慢慢出现错位——大量性能瓶颈根植在架构底层,补丁解得了燃眉之急,却捅不破架构先天筑起的天花板。

一道两难的选择题摆在团队面前:是顺着市场节奏继续缝缝补补,守住当下的订单;还是赌上巨大成本,向底层架构"动刀",从根源解开性能死结?在业务优先的现实压力面前,架构重构的设想,只能静静躺在架构师的草稿本里。

转机出现在2021年。深度测评之后,团队幡然醒悟:性能掉队,不是程序员写代码不够出色,而是旧架构天生带着局限。借国家重点研发计划的契机,浪潮数据联合高校专家反复碰撞,扎根国内真实业务场景,"数控分离"的颠覆性架构构想就此萌芽。团队没有头脑发热直接推倒重写,而是先把核心逻辑打磨成最小验证原型——当测试带宽跑出预期结果的那一刻,悬在所有人心里的石头才稍稍落地。

2023年,大模型浪潮呼啸而至。对接大量政企智算项目时,痛点真切摆在眼前:训练Checkpoint保存慢且易中断、推理KVCache访问抖动、海量科研影像吞吐上不去。更现实的是:NVMe SSD硬件迭代一日千里,可不少存储软件的设计逻辑还停留在机械硬盘的旧时代——先进的硬件被老旧的软件捆住手脚,客户采购的昂贵GPU算力无法全部兑现。

而真正为整个团队敲响警钟的,是一场全闪标段的竞标:依靠旧架构做项目调优,即便大量定制化适配,依旧很难满足极致性能场景下客户的诉求。市场给出了清醒提示——如果永远被订单牵着走,不沉淀底层核心能力,面对高要求的AI训推场景,短板便无处遁形。

经过内部反复争论与权衡,浪潮数据做出了那个关键的抉择:借鉴塔山阻击战"顾全大局、敢打必胜"的精神,代号Tashan(塔山)的独立预研团队正式成立。这是一块没有订单压力的"特区"——没有现成客户,没有短期KPI,所有人目标高度统一:从零搭建一套面向AI时代的全新存储架构,打造自主可控的AI存力底座。

放着能赚钱的项目不做,砸资源投入看不到即时收益的底层研发,意义在哪?答案很朴素:短期订单可以养活一支队伍,但底层架构的自主创新,才能攥住未来的技术话语权。

玄同架构:让每一块硬盘跑满,让每一分算力兑现

2026年,浪潮数据自研的玄同架构正式对外亮相。作为InData AIOS的核心内核,它的每一项设计都直击政企AI项目的真实痛点:

数控分离,数据直通硬件。传统分布式存储大多是数控一体架构,数据流要经控制节点中转转发,I/O路径被拉长。玄同架构开创性实现数控分离——控制面只管元数据与资源管理,业务数据流不再经控制节点转发,通过NVMeoF协议直接与SSD对话,I/O路径大幅缩短。

数据一次落盘,交互减半。搭配浪潮自研PCIe 5.0 NVMe SSD NS8000G7,将CRC校验元数据直接写入SSD自带的NVMe Meta区域,业务数据和校验信息一次落盘,I/O交互次数减少50%,有效削减写延迟。

智能负载均衡,盘间差距小于1%。InData AIOS分配数据时综合评估每一块SSD的容量、带宽、磨损状态,将盘间负载差距压缩至1%以内,让每一块硬件都跑满性能,杜绝部分硬盘过载、部分闲置的浪费。

小IO原地副本转纠删,告别二次搬运。传统方案处理KVCache碎片化小IO,需"副本池+纠删池"两级架构,后台搬迁会抢占前台资源、带来时延波动。InData AIOS独创小IO原地副本转纠删技术,直接在纠删池内部原地完成模式转换——好比图书馆不再把书先堆进过渡仓库再二次搬运,直接原地归档,消除搬迁损耗。

硬件感知数据流,压制长尾抖动。融合轮询机制、NUMA亲和调度、CPU绑核,IO工作交给高频专属核心,后台杂务调度到低频核心,最终IOPS翻倍、CPU利用率提升20%。叠加端到端NVMe通路、单边RDMA、零拷贝与全用户态IO栈(RTC无锁协程调度,可承载百万级并发IO),削减协议转换与内存拷贝开销,保障带宽持续稳定输出,不出现瞬时冲高后的性能跳水。

梳理这些技术细节不难发现:没有哪一项突破依靠单点黑科技,而是从架构、协议、调度算法到硬件协同的全链路系统性重构。硬件只是原材料,自研的AI数据操作系统InData AIOS,才是把原材料转化为业务价值的核心引擎。

存力兑现时刻

站在政企智算建设决策者的角度看,MLPerf® Storage V3.0的价值在于模拟真实生产加压,而非实验室理想环境。这意味着AS13000G7的成绩单不只是纸面数字,更是一份可参考的验证依据:这套基于玄同架构与InData AIOS的国产存储底座,足以扛住70B级大模型训练、高并发推理、医学影像科研等重负载业务,帮助用户规避GPU空转、业务时延抖动等现实风险。

放在国产存储产业坐标系里,这份成绩单的分量远不止五个第一。当前国内AI存储市场存在两种路径:一种是效率优先的整合模式——采购标准化硬件、基于开源组件做上层包装,可以快速抢占市场;但开源架构并非面向大模型训推、KVCache卸载这类AI原生负载设计,长周期高压生产环境下,时延抖动、带宽跑不满的问题很难根治。浪潮数据选择了周期更长、投入更高的底层自研路线,从玄同架构底层做起,直面政企私有化部署、数据合规、混合负载运维的真实痛点,完整走完了从技术跟随者到掌握自主架构话语权的闭环,为政企AI数字化提供一套完全国产、可落地、可演进的存力选项。

回望十年,国产基础软件的突围从来没有奇迹式的弯道超车。榜单上每一组亮眼数字背后,都是无数次验证、推翻、重构与打磨。在喧嚣风口之中守住战略定力,是这场十年长跑留给行业最珍贵的启示——真正的技术底气,从来不是一次榜单上的高光,而是一套扎根真实业务痛点、经过反复验证、可以持续生长的自主技术体系。

回到那个朴素的问题:存力兑现时刻,谁手握释放算力的金钥匙?答案不是单一硬件,也不是一次评测的高分,而是以浪潮数据为代表,扎根真实业务、完成底层系统重构的国产技术力量。

相关文章

A5创业网 版权所有