NVIDIA Nemotron 3 Super

nvidia/NVIDIA-Nemotron-3-Super-120B-A12B-BF16

参数量

120B

上下文

1024K

下载量

818.9K

点赞

415

架构

moe_transformer

在 HuggingFace 查看

GPU 需求

按量化方案和使用场景估算的显存 / 内存 / 磁盘

量化最低配置推荐配置生产配置
FP1616bit
287.7 GB
RAM 431.6 · Disk 387.7
316.3 GB
RAM 474.5 · Disk 413.7
426.1 GB
RAM 639.1 · Disk 452.7
FP88bit
146.3 GB
RAM 219.5 · Disk 213.3
168.5 GB
RAM 252.8 · Disk 239.3
271.8 GB
RAM 407.7 · Disk 278.3
INT88bit
146.3 GB
RAM 219.5 · Disk 213.3
168.5 GB
RAM 252.8 · Disk 239.3
271.8 GB
RAM 407.7 · Disk 278.3
AWQ4bit
78.3 GB
RAM 117.4 · Disk 129.4
97.4 GB
RAM 146.1 · Disk 155.4
197.6 GB
RAM 296.4 · Disk 194.4
GPTQ4bit
79.2 GB
RAM 118.8 · Disk 130.5
98.3 GB
RAM 147.4 · Disk 156.5
198.6 GB
RAM 297.9 · Disk 195.5
GGUF4bit
80.9 GB
RAM 121.4 · Disk 132.7
100.1 GB
RAM 150.2 · Disk 158.7
200.5 GB
RAM 300.8 · Disk 197.7

GPU 推荐

Best ValueBEST

4× H200 SXM

564 GB VRAM

$10,220/月

≈ 198.7 tok/s

可用生产吞吐 ≈ 139.1 tok/s

score 0.3154

Cheapest

8× Tesla V100

128 GB VRAM

$169/月

≈ 0 tok/s (N/A — benchmark unavailable)

可用生产吞吐 ≈ 0 tok/s

score 0.5536

Deploy on vast ↗
Performance

8× H200 SXM

1128 GB VRAM

$20,440/月

≈ 265 tok/s

可用生产吞吐 ≈ 185.5 tok/s

score 0.2197

Min Complexity

1× H200 SXM

141 GB VRAM

$2,555/月

≈ 82.8 tok/s

可用生产吞吐 ≈ 58 tok/s

score 0.6552

💬 社区 —— 真实部署经验

0 文章 · 0 实测

进入社区 →

单卡可运行的 GPU

H200 SXM

141 GB VRAM

$2,555

/月 · lambda

B200

180 GB VRAM

$3,013

/月 · vast

B200 SXM

180 GB VRAM

AmciHub

AI 模型部署与算力决策平台——分析 AI 模型的硬件需求、GPU 性能、云端价格与部署成本,帮助你选择合适的部署方案。

© 2026 AmciHub. 保留所有权利。 Model → Requirement → GPU → Benchmark → Cloud → Cost → Recommendation