AI Model Library — GPU VRAM Requirements, Benchmarks & Deployment Cost
Analyze AI model requirements, GPU performance, cloud pricing and deployment costs — 507 models
sentence-transformers
sentence-transformers/all-MiniLM-L6-v2
242.8M 6.1K22.3M
cross-encoder
cross-encoder/ms-marco-MiniLM-L6-v2
86.3M 35222.3M
BAAI
BAAI/bge-small-en-v1.5
63.3M 59433M
sentence-transformers
sentence-transformers/paraphrase-multilingual-MiniLM-L12-v2
46.3M 1.4K117.2M
google/electra-base-discriminator
46.1M 188108.4M
google-bert
google-bert/bert-base-uncased
41.2M 3.4K108.4M
BAAI
BAAI/bge-m3
35.9M 3.7K558M
Qwen
Qwen/Qwen3-0.6B
29.6M 1.7K507.9M
google-t5
google-t5/t5-small
24.1M 64260.5M
amazon
amazon/chronos-2
22M 498119.5M
Comfy-Org
Comfy-Org/MiniMax-H3
22M 2K33.1B
openai
openai/clip-vit-base-patch32
21.6M 1.6K148M
timm
timm/mobilenetv3_small_100.lamb_in1k
20.7M 1232.6M
sentence-transformers
sentence-transformers/all-mpnet-base-v2
20.5M 1.4K108.4M
FacebookAI
FacebookAI/xlm-roberta-base
17.3M 925276.9M
Qwen
Qwen/Qwen3-VL-8B-Instruct
17.1M 1.2K8.3B
BAAI
BAAI/bge-reranker-v2-m3
17.1M 1.2K558M
jonatasgrosman
jonatasgrosman/wav2vec2-large-xlsr-53-japanese
16.7M 88304.4M
openai-community
openai-community/gpt2
15.6M 4.2K137M
nomic-ai
nomic-ai/nomic-embed-text-v1.5
13.5M 943108.4M
google/gemma-4-26B-A4B-it
12.5M 1.6K4B
intfloat
intfloat/multilingual-e5-small
11.9M 432117.2M
Qwen
Qwen/Qwen3-8B
11.7M 2.1K7.9B
trl-internal-testing
trl-internal-testing/tiny-Qwen2ForCausalLM-2.5
11.5M 531.2M