铭信 FX 与 NVIDIA CMX:同一层上下文存储,两条交付路径
NVIDIA CMX 是绑定 Rubin/BlueField-4 的原厂 KV 上下文层;铭信 FX 做同一层,已量产且 480B 签字实测吞吐 +29–40%。
如实呈现:CMX 解决什么、强在哪里
NVIDIA CMX(Context Memory eXtension / Context Memory Storage Platform)是 2026 年公开的 AI 原生上下文存储层:用 BlueField-4 管理以太网闪存,在显存、主机内存、本地盘与传统网络存储之间插入 G3.5 层,专门承接长上下文、多轮与 Agent 推理的 KV Cache(公开资料口径,产品页 https://www.nvidia.com/en-us/data-center/ai-storage/cmx/)。
软件侧由 Dynamo 做 KV 感知路由、NIXL 做搬运、DOCA Memos 把闪存暴露为 pod 级 KV API;网络侧走 Spectrum-X Ethernet。对全 NVIDIA Rubin 集群,这是原厂共设计路径——软硬件一体、能效与调度与 GPU 拓扑对齐,这是第三方阵列结构上做不到的事。
性能数字:NVIDIA 产品页写「最高约 5× 吞吐、5× 能效(相对传统存储)」。对照基线与负载未公开,本站不把它与铭信实测横比,也不转述未在产品页出现的其他倍数。
交付:NVIDIA 产品页未公布量产交付日;合作伙伴与行业报道口径为 2026 年下半年随 Rubin / BlueField-4 出货。在出货前,CMX 不能作为「现在可联测」的选项。
铭信 FX 在这张图里的位置
同一层,不同绑定。FX 系列全闪 NVMe-oF 阵列 + vLLM/LMCache 分层栈,做的也是「把 KV 从显存下沉到可共享的全闪池」。差别是:不绑定 BlueField-4 / Rubin,用标准 100GbE RoCEv2;软件走开源栈的源码级适配(并行读补丁见 R1/R8)。
已能量化的锚点(签字级,可下载):480B 生产形态吞吐 +29–40%、TTFT −26–32%、对无外存重算 8.6–20×(R2/R3);跨实例 fs:// 热共享验证通过(R3);平台覆盖 AMD MI308X(R1–R4)、昇腾 910B(R9)、沐曦 N260(R5 方法论)。
与 CMX 的关系一句话:在 N 卡 Rubin 集群上,CMX 是原厂路径,FX 可作为标准 NVMe-oF 下沉目标——与 CMX / DOCA Memos 原厂栈的对接未经联测,不预支。在非 N 卡集群上,CMX 生态覆盖未见公开适配,FX 是已实测可交付的完整栈。对照基线是无外存重算,不是尚未出货的 CMX。
选型建议
全 NVIDIA Rubin、接受原厂节奏:优先评估 CMX。国产 / 异构算力(MI308X、昇腾、沐曦),或现在就要按门禁联测:把铭信 FX 纳入比较。两者并测的客户同样欢迎——G3 主门禁(TTFT 降幅 ≥25%、吞吐落在 +29–40% 实测带内)对谁都公平。
一页纸架构图见官网「技术架构」页(投屏或打印为一页纸)。
常见问题
CMX 的 5× 和铭信的 29–40% 谁更快?
不能横比。5× 是 NVIDIA 相对「传统存储」的厂商口径,基线与负载未公开;29–40% 是 480B·TP8 相对本地 NVMe 单盘的签字实测(R2/R3)。分母不同,放在同一行比较会误导。
用了 Dynamo 还要不要 CMX 或 FX?
要。Dynamo 是编排框架,KV 数据仍须落在某层介质上。CMX 是 NVIDIA 原厂的 G3.5 介质;FX 是标准 NVMe-oF 介质。框架与存储层互补,不是二选一。
铭信能不能对接 DOCA Memos / CMX?
未经联测,不宣称兼容。FX 对 Dynamo/NIXL 的口径止于「标准 NVMe-oF 下沉目标」。原厂栈对接以联测报告回填。
数据出处(可查证)
相关阅读
本站内容为商务合作信息展示,不构成投资要约或任何收益承诺。实测数据均出自签字级/正式版测试报告(见证据库);厂商口径、公开口径、估算口径均如实标注。