铭信
R1测试日期 2026-07-03签字级 / 正式版

FX100 大模型推理与训练 综合性能测试报告(AMD MI308X ×8)

测试范围

LMCache 并行读补丁、KV 分层多卡扩展、模型并发加载、模型切换有效 TPS、训练 checkpoint 并发写(Qwen2.5-32B/7B)

原始文件名:test/AISSD5000-综合性能测试报告-AMD-MI308X.pdf

测试平台(免费公开)

8 × AMD Instinct MI308X(每卡 192 GB HBM,gfx942);2 × AMD EPYC 9654(384 线程),≈1.5 TB 内存;ROCm 7.2;vLLM 0.20.1+rocm721;LMCache(上游主线 2026-06-29 源码编译)。被测设备:铭信 FX100 全闪 NVMe-oF 阵列:4 盘 RAID0(14 TB, XFS),RoCEv2,单口 100 GbE。对照基线:本地 NVMe 单盘(PCIe Gen4, 2 TB);无外存重算。

本报告支撑的关键实测数字(免费公开)

这些数字本身不设付费墙——它们是本站对外承诺的性能结论,任何人都应当能免费核对。 付费部分是报告原件:完整测试方法、逐档原始数据、图表、截图与签章。

4.1×
LMCache 并行读补丁 TTFT 改善

单卡·并发16·冷读盘(Qwen2.5-32B):TTFT 37.97s → 9.30s,带宽 0.98 → 5.23 GB/s(↑5.3×)

口径:实测R1 实测

1.9×
训练 Checkpoint 保存加速

8 卡 32B LoRA、每份 65.6GB 整模型快照:178s → 94s,持续写带宽 3.26 → 6.40 GB/s(+96%)

口径:实测R1 实测

该报告支撑的解决方案

获取完整报告原件

付费即可下载 2 个文件:签字中文原件 + 英文参考译文(同一份研究成果不按语言二次收费)。 下载链接自购买起 7 天内有效,最多下载 10 次; 付款后页面立即可下载,同时邮件补发一份链接。

销售方:王启源(个人);记录商户:Creem(由其向买家开票并申报各国 VAT/GST)。结账页支持信用卡/借记卡、Apple Pay、Google Pay,暂不支持微信与支付宝付款; 无国际卡请联系support@mingxinstorage.xyz。许可范围与退款政策见服务条款

英文 PDF 为 AI 参考译文(数字保真机检),签字中文原件为权威版本,图表/截图/签章仅见原件。 本页内容不构成投资建议。