铭信
铭信技术架构
EN

TECHNICAL BRIEF · 对照 NVIDIA CMX

同一层上下文。两条交付路径。

显存装不下的 KV Cache,不重算。NVIDIA CMX 与铭信 FX 补的是同一层:G3.5 上下文存储。

480B 长上下文冷恢复 · TTFT p50 · 并发 16

149.5无外存重算
11.85FX100 分层

对无外存重算 8.6–20× · R2 签字实测

G1
显存 HBM热会话192 GB / 卡
G2
主机内存近期会话≈1.5 TB / 节点
G3
本地 NVMe节点内2 TB 单盘
CMX 或 FX 落在这一层
G3.5
上下文存储层跨节点共享 KV184 TB / 台(FX100 满配)
G4
网络存储模型与归档NFS / 对象存储
更快 · 更小 · 更贵

两边都补 G3.5。都不替代 HBM。 · 容量为 R2 测试平台口径

更大 · 更慢 · 可共享

同一层。不同绑定。

5× 与 +29–40% 分母不同,不能横比。

NVIDIA CMX

公开 / 厂商口径
最高约 5×相对「传统存储」· 基线与负载未公开
绑定
Rubin · BlueField-4
覆盖
NVIDIA 加速器
软件栈
Dynamo · NIXL · DOCA Memos
交付
报道 2026 下半年

铭信 FX

签字实测
+29–40%480B · TP8 吞吐 · TTFT −26–32% · R2/R3
绑定
标准 100GbE RoCEv2
覆盖
MI308X · 昇腾 · 沐曦
软件栈
vLLM · LMCache 源码级适配
交付
FX100 / 200 / 300 在售
01
全 NVIDIA Rubin先评估原厂 CMX
02
国产 / 异构算力FX 已实测、现可交付
03
现在就要联测十周门禁,不达标即止损

NVIDIA 数字为厂商公开口径,基线未披露。铭信数字全部附报告编号(R1–R9),接受复验。不构成贬损或替代承诺。 NVIDIA CMX 产品页 · NVIDIA Technical Blog