LLMLlama
hmellor/tiny-random-LlamaForCausalLM
hmellor/tiny-random-LlamaForCausalLM
参数量
1.1M
上下文
8K
下载量
4.2M
点赞
1
架构
llama
2 layers · 4 KV heads · head 64 · hidden 16
GPU 需求
按量化方案和使用场景估算的显存 / 内存 / 磁盘
| 量化 | 最低配置 | 推荐配置 | 生产配置 |
|---|---|---|---|
| FP1616bit | 2.2 GB RAM 32.0 · Disk 39.0 | 2.5 GB RAM 32.0 · Disk 65.0 | 3.6 GB RAM 32.0 · Disk 104.0 |
| FP88bit | 2.2 GB RAM 32.0 · Disk 39.0 | 2.5 GB RAM 32.0 · Disk 65.0 | 3.6 GB RAM 32.0 · Disk 104.0 |
| INT88bit | 2.2 GB RAM 32.0 · Disk 39.0 | 2.5 GB RAM 32.0 · Disk 65.0 | 3.6 GB RAM 32.0 · Disk 104.0 |
| AWQ4bit | 2.2 GB RAM 32.0 · Disk 39.0 | 2.5 GB RAM 32.0 · Disk 65.0 | 3.6 GB RAM 32.0 · Disk 104.0 |
| GPTQ4bit | 2.2 GB RAM 32.0 · Disk 39.0 | 2.5 GB RAM 32.0 · Disk 65.0 | 3.6 GB RAM 32.0 · Disk 104.0 |
| GGUF4bit | 2.2 GB RAM 32.0 · Disk 39.0 | 2.5 GB RAM 32.0 · Disk 65.0 | 3.6 GB RAM 32.0 · Disk 104.0 |
GPU 推荐
Best ValueBEST
1× RTX 5080
16 GB VRAM
$97.8/月
≈ 0 tok/s (N/A — benchmark unavailable)
可用生产吞吐 ≈ 0 tok/s
score 0.5357
Cheapest
1× Tesla V100
16 GB VRAM
$21.1/月
≈ 0 tok/s (N/A — benchmark unavailable)
可用生产吞吐 ≈ 0 tok/s
score 0.5304
Performance
8× H200 SXM
1128 GB VRAM
$20,440/月
≈ 0 tok/s (N/A — benchmark unavailable)
可用生产吞吐 ≈ 0 tok/s
score 0.2197
Min Complexity
1× RTX 5060 Ti
8 GB VRAM
$39.7/月
≈ 0 tok/s (N/A — benchmark unavailable)
可用生产吞吐 ≈ 0 tok/s
score 0.574
💬 社区 —— 真实部署经验
0 文章 · 0 实测
单卡可运行的 GPU
Tesla V100
16 GB VRAM
$21.1
/月 · vast
RTX 5060 Ti
8 GB VRAM
$39.7
/月 · vast
RTX 4070S Ti
16 GB VRAM
$49.5
/月 · vast
RTX 5070
12 GB VRAM
$58.7
/月 · vast
RTX 5070 Ti
16 GB VRAM
$62.0
/月 · vast