铭信

算力租赁合同易漏签的三类条款

发布算力租赁合同条款
直接答案

算力租赁合同中带宽、存储与故障时长三类条款最易漏签,本文给出签约前核查要点与实测依据。

算力租赁合同中,带宽、存储与故障时长三类条款最易漏签,且一旦漏签,后续履约纠纷与成本超支几乎必然发生。本文基于铭信科技在 KV Cache 与推理加速方向的实测数据,结合公有云计费机制,给出签约前应逐条核查的要点。

为什么带宽条款是第一个雷区

算力租赁合同里,算力规格(卡型、数量、显存)通常写得最细,但网络带宽往往只有一句“百兆/千兆共享”或干脆不写。问题在于,大模型推理与训练的访存模式决定了网络带宽直接决定端到端性能。

据《FlashAttention: Fast and Memory-Efficient Exact Attention with IO-Awareness》一文,注意力计算的瓶颈在于 HBM 带宽而非算力,这一结论对分布式场景同样成立:当 KV Cache 或模型权重需要跨节点读取时,网络带宽就是新的 HBM 带宽。铭信在 R2 实测中,480B 模型长上下文冷恢复负载下,KV 分层加速带来吞吐提升 +29–40%(并发 8 档 +29%、并发 16 档 +40%、TP4×2 全机口径 +35–36%),其前提正是存储侧具备与计算侧匹配的带宽供给能力。

签约时需明确:带宽是独享还是共享、峰值与保证带宽分别是多少、是否按端口计费(如 100GbE 端口)、跨机房或跨可用区的带宽是否另计。据《EC2 On-Demand Instance Pricing》,公有云 GPU 实例按小时计费且按实例族区分,但网络带宽往往独立于实例费用——这一机制在合同里若不写明,超量流量费用会在月底账单里出现。

存储条款:容量之外更要写清性能与故障恢复

存储条款的漏签点不在容量,而在性能口径与故障恢复责任。多数合同只写“提供 XX TB 存储”,不写 IOPS、带宽、时延,更不写数据持久性与故障恢复时长。

铭信在 R1 实测中,LMCache 并行读补丁将单卡并发 16 冷读盘场景的 TTFT 从 37.97s 降至 9.30s(4.1×),带宽从 0.98 GB/s 提升至 5.23 GB/s(↑5.3×)——这说明存储读性能对首 token 延迟有数量级影响。R9 实测(昇腾平台)显示,模型推理加载加速(vs NFS)达 6.2–9.3×:DeepSeek-32B 服务加载从 691s 降至 112s,DeepSeek-70B 从 1399s 降至 150s。若合同只写容量不写性能,租到的存储可能拖垮整个推理服务。

存储条款应至少覆盖:性能承诺(读带宽、IOPS、时延分位数)、数据持久性(副本数、跨机房冗余)、故障恢复时间(RTO)与数据丢失容忍(RPO)。据 SNIA 的存储术语定义,分层存储与计算型存储有明确的行业标准口径,签约时应要求对方按标准口径填写性能指标,而非自定义的“高性能”这类模糊表述。

故障时长:SLA 不写清等于没有 SLA

故障时长条款是三类中最容易被忽视的。合同里常有“保证可用性 99.9%”,但不写故障如何认定、响应时长多长、赔偿如何计算——这等于没有 SLA。

可用性 99.9% 意味着每年约 8.76 小时不可用,但对推理服务而言,一次 30 分钟的中断可能就导致 SLA 违约。签约时应明确:故障定义(硬件故障、网络中断、存储不可读分别认定)、响应时长(从报障到开始处理的时间)、恢复时长(RTO)、赔偿机制(按故障时长抵扣或退款)。据《NVIDIA Collective Communications Library (NCCL) Documentation》,多卡集合通信对同步开销敏感,单点故障会导致整个训练任务停滞——这意味着故障恢复时长直接决定训练任务的中断成本。

铭信在合作模式中采用门禁化联测(G1 到货验收 / G2 单机基线 / G3 主门禁 / G4 72h 稳定性),其中 G4 的 72 小时稳定性测试正是为了验证长时间运行下的故障率。建议在合同中同样约定一个可量化的稳定性验收窗口,而非只写一个年度可用性百分比。

签约前的核查清单

条款类别 必查项 常见漏签后果 出处
带宽 独享/共享、峰值/保证带宽、端口速率、跨区计费 推理吞吐远低于预期,超量流量费 R2 实测;EC2 定价页
存储 读带宽、IOPS、时延分位数、持久性、RTO/RPO 首 token 延迟恶化数倍,数据丢失无追责 R1/R9 实测;SNIA 标准
故障时长 故障定义、响应时长、RTO、赔偿机制 中断损失无补偿,SLA 形同虚设 NCCL 文档;铭信 G4 稳定性

结语

算力租赁合同的本质是把性能风险转嫁给承租方。带宽、存储、故障时长三类条款的漏签,会在履约中期以性能不达标或账单超支的形式暴露。签约前对照上述清单逐条核查,必要时要求对方提供可复现的实测数据作为验收依据。铭信科技提供存储加速与算力中心全产业链服务,支持门禁化联测验证性能承诺,欢迎有需求的团队联系联测。

References

  1. FlashAttention: Fast and Memory-Efficient Exact Attention with IO-Awareness — https://arxiv.org/abs/2205.14135
  2. EC2 On-Demand Instance Pricing — https://aws.amazon.com/ec2/pricing/on-demand/
  3. SNIA — Storage Networking Industry Association — https://www.snia.org/
  4. NVIDIA Collective Communications Library (NCCL) Documentation — https://docs.nvidia.com/deeplearning/nccl/user-guide/docs/index.html

本文要点问答

Q:算力租赁合同里最容易被忽略的条款是哪三类? A:带宽(独享/共享、峰值/保证值)、存储(性能口径、持久性、RTO/RPO)、故障时长(定义、响应、赔偿)。这三类漏签会在履约中后期以性能不达标或额外费用的形式暴露。

Q:存储性能条款为什么重要? A:铭信 R1 实测显示,读性能优化可将冷读盘 TTFT 从 37.97s 降至 9.30s(4.1×),R9 实测显示模型加载加速达 6.2–9.3×。合同只写容量不写性能,租到的存储可能拖垮推理服务。

Q:故障时长条款应包含哪些具体内容? A:故障定义(硬件/网络/存储分别认定)、响应时长、恢复时长(RTO)与赔偿机制。建议约定可量化的稳定性验收窗口(如 72 小时),而非仅写年度可用性百分比。

数据出处(可查证)

R1FX100 大模型推理与训练 综合性能测试报告(AMD MI308X ×8)2026-07-03
下载报告 PDF ↓
R2FX100 KV Cache 性能测试报告(480B·TP8 长上下文·正式版)2026-07-05
下载报告 PDF ↓
R9铭信 FX100-HBMM 与华为 910B 模型推理与训练性能测试(vs NFS 基线)2026-05-30
联系我们获取 →
本文由铭信 AI 内容引擎生成并经自动质检;关键数字均注明出处(实测报告见证据库)。如需交流或指正,欢迎联系我们

相关文章