返回首页
[ 行业新闻 ] 2026-09-16 13:35

AI存储性能新王者:焱融F9000X登顶MLPerf,云服务器ECS选型该看什么?

AI存储性能新王者:焱融F9000X登顶MLPerf,云服务器ECS选型该看什么?

AI存储性能的纪录又被刷新了!焱融科技F9000X在MLPerf Storage v3.0中拿下了544GiB/s聚合带宽等多项第一,给AI推理与训练带来了实打实的底气。对企业上云来说,高性能云服务器ECS和存储方案同样重要。看懂最新的AI存储趋势,才能更合理地规划云端架构。

MLPerf Storage v3.0:AI存储的“奥运赛场”

MLPerf是AI领域公认的权威基准评测之一,Storage测试专门衡量存储系统在AI负载下的真实表现。焱融F9000X这次用三节点集群,就拿下了3D U-Net数据供给测试的544GiB/s聚合带宽,还在Checkpoint 70B测试里读写带宽双双登顶。这是什么概念?相当于同时给几千张GPU卡喂数据,而且不停顿。

要知道,AI训练时存储常常是最大瓶颈。GPU算得再快,数据供不上就只能干等。F9000X这种表现,等于把“粮草”问题彻底解决了。对做AI大模型的企业来说,存储性能直接决定训练效率,省下来的时间就是真金白银。

KVCache测试登场,推理场景被重新定义

这次MLPerf Storage v3.0新增了KVCache测试项,专门模拟多轮会话中KV Cache的整体写入与回读,输出Token吞吐、读写带宽及P95读取时延。以前基准测试侧重训练,但AI推理(尤其是大模型对话)的重要性越来越高。KVCache相当于模型的“记忆”,多轮对话时每次都要读写这部分数据,慢一点都不行。

焱融在推理这块也早有准备。他们推出了AI原生推理存储系统YRCache和共享缓存一体机ContextBox。ContextBox最多配26块U.2 NVMe SSD和4块NVIDIA BlueField-3 200Gb DPU,通过RDMA/RoCE能跑出120GB/s实测带宽,单台就能支撑8节点集群。这硬件堆料,确实够猛。

推理延迟狂降89%,Token吞吐翻6倍

光看参数不够,还得看实际效果。焱融在8卡NVIDIA H20-3e、运行SGLang与GLM-5.1的环境下做了测试,接上YRCache和ContextBox后,31K至129K长输入区间的首Token时延降低了89%到94%,Token吞吐量提升了3到6倍。简单说,用户问一句话,模型“开口”更快了,回答也更流畅了。

这背后是缓存命中率的作用。多轮对话中,历史上下文和KV Cache都被缓存起来,不用重复计算。对需要高频推理的服务,比如智能客服、AI助手,这种提升就是实打实的成本节省和体验升级。

企业上云,选对存储和计算同样关键

看到这里,你可能会问:这些性能怪兽跟我的业务有什么关系?其实,AI存储的进步正在改变企业的上云策略。过去大家只盯着CPU、GPU,忽略存储和网络。现在你会发现,高吞吐、低时延的存储方案,能让GPU利用率翻倍。焱融自己也测算过,在64K输入、50%缓存命中率、GPU持续满载的理想假设下,单台8卡服务器的月度等效产值可以从5.2万元提升到11.9万元。不过这个数字只是理论换算,不是真实营收或净利润,但也能说明问题。

企业上云时,云服务器ECS依旧是最基础的算力单元。不过算力再强,也得有匹配的存储架构。不少公司会通过易枫顺 - 阿里云官方旗舰级代理商获取云资源,因为代理商不仅能提供专业的上云方案,还能帮忙申请阿里云优惠和阿里云代金券,降低试错成本。比如选配云服务器ECS实例时,如果你打算跑AI推理,就得注意内存带宽和本地存储的IOPS,别只顾着GPU规格。

阿里云代理商的价值在于,能把复杂的云端资源组合成适合你业务的方案。无论是自建存储还是用云上ESSD,都要权衡性能和成本。而阿里云代金券虽然看着小,长期用下来能省不少。毕竟现在AI训练和推理的账单,大头可不止在GPU上。

FAQ

Q: MLPerf Storage v3.0的KVCache测试为什么重要?

A: 因为它第一次把推理场景中的KV Cache读写性能纳入标准评测。多轮对话、长上下文都要反复读写这部分数据,延迟稍高,用户体验就会变差。KVCache测试直接反映存储系统对推理负载的支撑能力,是选型的重要参考。

Q: 焱融F9000X的544GiB/s带宽是普通企业能用的吗?

A: F9000X面向高端AI训练和推理场景,普通中小型企业可能用不到这么极致的性能。但它的技术方向——比如高速NVMe、RDMA网络、智能缓存——会逐步下放到云服务和更亲民的存储方案里。如果你通过阿里云代理商选配云服务器ECS,同样能享受到底层存储优化的红利。

Q: 企业上云时,存储和计算应该优先升级哪个?

A: 看瓶颈。如果GPU利用率很低,数据加载总是卡住,那先解决存储;如果算力本身不够,再升级ECS。很多时候,加一块高速缓存盘或调整存储架构,比盲目加GPU更省钱。建议找像易枫顺这样的阿里云代理商做个免费方案评估。

关于易枫顺

深圳市易枫顺网络科技有限公司是阿里云官方旗舰级代理商。提供云服务器ECS、云数据库RDS、对象存储OSS等阿里云全系产品官方特惠折扣与代金券申请,以及多云成本优化、企业上云一站式服务。客服热线:19520841949 - 易枫顺

易枫顺 - 阿里云官方旗舰级代理商

来源:InfoQ

微信扫码咨询

微信二维码