H100 现货中位价 $2.07/h,较前日回落28.4%;B200 站上 $7.70/h。当前可即时租到的数据中心卡为 B300、B200、H200、H100
数据中心旗舰价格梯度
on-demand 全市场标价 · 单卡 $/h · 按中位价降序(n = 报价样本数)
| 型号 | 单卡显存 | 最低 | 中位 | 最高 | 样本 | 日环比 |
| B300 | 288 GB | $7.89 | $7.89 | $7.89 | 1 ⚠ | — |
| B200 | 192 GB | $2.50 | $7.70 | $42.00 | 4 | 持平 |
| H200 | 141 GB | $2.25 | $6.16 | $6.50 | 5 | 持平 |
| H100 | 80 GB | $1.25 | $2.07 | $3.29 | 7 | ◇ 异动 28% |
| L40S | 48 GB | $0.990 | $1.84 | $2.70 | 2 ⚠ | — |
| A100 | 80 GB | $0.136 | $1.39 | $1.59 | 3 | — |
| L4 | 24 GB | $0.490 | $0.655 | $0.820 | 2 ⚠ | — |
| A6000 | 48 GB | $0.530 | $0.530 | $0.530 | 1 ⚠ | — |
| V100 | 16 GB | $0.027 | $0.027 | $0.029 | 6 | ▲ 3.8% |
实时可租流动性
当前时点真正能下单租到的型号(on-demand rentable)· 反映供给紧张度
跨源价差 · 按时租 vs Serverless
同型号 on-demand(Vast.ai / RunPod Pod 裸卡)对比 serverless(RunPod 托管,含运维溢价)
on-demand 按时租serverless 含溢价
旗舰卡价格趋势
数据中心级 on-demand 中位价 · 2026-06-29 起 61 日走势
消费级 / 工作站卡
RTX 系列及工作站卡 on-demand 标价 · 单卡 $/h
口径说明。on-demand 为按小时租用整机后折算的单卡价(Vast.ai dph_total / RunPod Pod 整机价除 GPU 数);serverless 为 RunPod 按用量计费,含运维溢价,与裸卡口径不同,仅作参考。跨源验证只在同口径内进行。CoreWeave 等企业云整机实例含 CPU/RAM/SLA,与裸卡不可直接比,且采集端受反爬限制,on-demand 中可能缺失。样本量小(n 较低)的型号价格波动大,解读需谨慎。
若以万卡(10,000 卡)集群、24×7 全年运行、按 1 年期长租测算,H100 集群年租成本约 $1.27 亿/年,B200 约 $4.72 亿/年。长租折让取 30%(现货 × 0.70)。
集群规模 10,000 卡
运行 24×7 全年(8,760 h)
长租折让 30%
基准 on-demand 现货中位价
万卡集群年租成本
数据中心级 GPU · 亿美元 / 年 · 按 1 年期长租单价测算
| 型号 | 现货 $/h | 长租 $/h | 万卡年成本 | (百万美元) |
| B300 ⚠ | $7.89 | $5.52 | $4.84 亿 | $484M |
| B200 | $7.70 | $5.39 | $4.72 亿 | $472M |
| H200 | $6.16 | $4.31 | $3.77 亿 | $377M |
| H100 | $2.07 | $1.45 | $1.27 亿 | $127M |
| L40S ⚠ | $1.84 | $1.29 | $1.13 亿 | $113M |
| A100 | $1.39 | $0.973 | $0.85 亿 | $85M |
| L4 ⚠ | $0.655 | $0.458 | $0.40 亿 | $40M |
| A6000 ⚠ | $0.530 | $0.371 | $0.32 亿 | $32M |
| V100 | $0.027 | $0.019 | $0.02 亿 | $2M |
测算方法。年租成本 = 现货中位价 × (1 − 长租折让) × 8,760 小时 × 10,000 卡。长租单价基于 on-demand 现货中位价按 30% 折让推算 —— 该折让锚定 SemiAnalysis 2026 年 3 月 H100 一年期租约价格指数 $2.35/hr/GPU(基于 100+ 市场参与者调研 + 真实成交验证的合约市场价,非挂牌价),与本站同期采集的 H100 现货中位价对比隐含约 26% 折让;并交叉参考 GMI Cloud(1–3 年期 30–60%)、Spheron(12 个月 20–40%)、JarvisLabs(24×7 承诺 30–40%)等公开口径,集中落在 30–40% 区间。考虑当前市场供给极度紧张、on-demand 全线售罄、长租折让正在收窄,取相对保守的 30% 为基准。
口径边界。此为纯 GPU 租赁现金成本,不含数据中心电力、网络(InfiniBand)、存储、运维人力及模型训练本身的机会成本;企业云整机方案(CoreWeave 等含 CPU/RAM/SLA)实际报价通常更高。测算仅取现货中位价外推,样本量小的型号(标 ⚠)波动大,结果为量级参考而非精确报价。