Image GenerationFLUXApache-2.0

FLUX.1-schnell

black-forest-labs/FLUX.1-schnell

FLUX.1-schnell, 4-step fast generation.

Parameters

12B

Context

4K

Downloads

2.1M

Likes

5.2K

Architecture

flux

View on HuggingFace

GPU Requirements

VRAM / RAM / disk estimates by quantization and usage scenario

QuantizationMinimumRecommendedProduction
FP1616bit
47.6 GB
RAM 71.3 · Disk 73.9
50.9 GB
RAM 76.3 · Disk 99.9
55.5 GB
RAM 83.2 · Disk 138.9
FP88bit
25.4 GB
RAM 38.1 · Disk 56.4
27.7 GB
RAM 41.6 · Disk 82.4
31.3 GB
RAM 47.0 · Disk 121.4
INT88bit
25.4 GB
RAM 38.1 · Disk 56.4
27.7 GB
RAM 41.6 · Disk 82.4
31.3 GB
RAM 47.0 · Disk 121.4
AWQ4bit
14.8 GB
RAM 32.0 · Disk 48.0
16.6 GB
RAM 32.0 · Disk 74.0
19.7 GB
RAM 32.0 · Disk 113.0
GPTQ4bit
14.9 GB
RAM 32.0 · Disk 48.2
16.8 GB
RAM 32.0 · Disk 74.2
19.9 GB
RAM 32.0 · Disk 113.2
GGUF4bit
15.2 GB
RAM 32.0 · Disk 48.4
17.0 GB
RAM 32.0 · Disk 74.4
20.2 GB
RAM 32.0 · Disk 113.4

GPU Recommendations

Best ValueBEST

1× RTX 5090

32 GB VRAM

$244/mo

≈ 78.4 img/min

Effective production throughput ≈ 54.9 images/min

score 0.6361

Deploy on vast ↗
Cheapest

1× RTX 3090

24 GB VRAM

$45.4/mo

≈ 26.6 img/min

Effective production throughput ≈ 18.6 images/min

score 0.6802

Deploy on vast ↗
Performance

8× H100 SXM

640 GB VRAM

$9,378/mo

≈ 200.7 img/min

Effective production throughput ≈ 140.5 images/min

score 0.2412

Deploy on vast ↗
Min Complexity

1× RTX 4090

24 GB VRAM

$98.1/mo

≈ 61.9 img/min

Effective production throughput ≈ 43.3 images/min

score 0.6796

Deploy on vast ↗

💬 Community — real deployment experience

0 Articles · 0 Benchmarks

View Community →

GPUs that fit (single card)

RTX 3090

24 GB VRAM

$45.4

/mo · vast

RTX 4090

24 GB VRAM

$98.1

/mo · vast

RTX 4090D

24 GB VRAM

$117

/mo · vast

L4

24 GB VRAM

$148

/mo · vast

A10

24 GB VRAM

$176

/mo · vast

AmciHub

AI Model Deployment & Compute Intelligence — analyze AI model requirements, GPU performance, cloud pricing and deployment costs to find the right deployment solution.

© 2026 AmciHub. All rights reserved. Model → Requirement → GPU → Benchmark → Cloud → Cost → Recommendation