Loading
Taking longer than expected.
Reload page

Find the machine for your model. Sized by memory.

51 model entries. Compare GPU memory figures and their sources before choosing a machine configuration.

These are catalog sizing thresholds, planning estimates and external reports. Context, concurrency and runtime overhead can increase memory use. A memory match does not establish a tested deployment, throughput or live capacity.

ModelParamsServe VRAM sizingFine-tune VRAM sizing
Kimi K2.6 MoE1000B600 GB (4-bit)not listed
DeepSeek V4 Pro671B400 GB (4-bit)not listed
MiniMax M2230B138 GB (4-bit); 140 GB (Runtime default)200 GB (QLoRA)
gpt-oss 120B120B72 GB (4-bit); 80 GB (Runtime default)90 GB (QLoRA)
Llama 3.2 Vision 90B90B55 GB (4-bit); 64 GB (Runtime default); 216 GB (16-bit)68 GB (QLoRA)
Qwen2.5-VL 72B72B45 GB (4-bit); 48 GB (Runtime default); 173 GB (16-bit)54 GB (QLoRA)
Llama 3.3 70B70B42 GB (4-bit); 80 GB (Runtime default); 84 GB (8-bit); 168 GB (16-bit)53 GB (QLoRA)
LLaVA 34B34B24 GB (Runtime default)26 GB (QLoRA)
Qwen3 32B32B22 GB (4-bit); 32 GB (Runtime default); 77 GB (16-bit)24 GB (QLoRA)
Qwen Coder 32B32B32 GB (Runtime default)24 GB (QLoRA)
DeepSeek-R1 32B32B32 GB (Runtime default)24 GB (QLoRA)
Qwen2.5 32B Instruct32B32 GB (Runtime default)24 GB (QLoRA)
Qwen2.5-VL 32B32B24 GB (Runtime default)24 GB (QLoRA)
MOVA 720p + audio (SGLang)32Bnot listednot listed
Qwen3 30B A3B30B20 GB (4-bit); 32 GB (Runtime default)23 GB (QLoRA)
Qwen3 Coder 30B30B20 GB (4-bit); 32 GB (Runtime default)23 GB (QLoRA)
Gemma 3 27B27B18 GB (4-bit); 24 GB (Runtime default); 65 GB (16-bit)21 GB (QLoRA)
Qwen3 Coder 27B27B32 GB (Runtime default)20 GB (QLoRA)
Mistral Small 24B24B16 GB (4-bit); 24 GB (Runtime default); 29 GB (8-bit)18 GB (QLoRA)
Devstral Small 24B24B16 GB (Runtime default)18 GB (QLoRA)
Mistral Small 3.1 24B (Vision)24B18 GB (Runtime default)18 GB (QLoRA)
gpt-oss 20B20B16 GB (4-bit); 24 GB (Runtime default)15 GB (QLoRA)
Qwen3 14B14B16 GB (Runtime default); 24 GB (Runtime default)11 GB (QLoRA)
Qwen2.5 Coder 14B14B16 GB (Runtime default)11 GB (QLoRA)
Phi-4 14B14B16 GB (Runtime default)11 GB (QLoRA)
DeepSeek-R1 14B14B16 GB (Runtime default)11 GB (QLoRA)
Qwen2.5 14B Instruct14B16 GB (Runtime default)11 GB (QLoRA)
Wan2.1 14B14B40 GB (Runtime default)not listed
LLaVA 13B13B10 GB (Runtime default)10 GB (QLoRA)
HunyuanVideo13B48 GB (Runtime default)not listed
Gemma 3 12B12B16 GB (Runtime default)9 GB (QLoRA)
Llama 3.2 Vision 11B11B8 GB (Runtime default)8 GB (QLoRA)
Qwen3 8B8Bnot listed6 GB (QLoRA)
Granite 3.3 8B8Bnot listed6 GB (QLoRA)
Llama 3.1 8B8B8 GB (Runtime default)6 GB (QLoRA)
DeepSeek-R1 8B8B8 GB (Runtime default)6 GB (QLoRA)
Qwen3 Coder 8B8Bnot listed6 GB (QLoRA)
Qwen3 Embedding 8B8B18 GB (Runtime default)not listed
MiniCPM-V 2.6 8B8B7 GB (Runtime default)6 GB (QLoRA)
LLaVA-Llama3 8B8B7 GB (Runtime default)6 GB (QLoRA)
Mistral 7B7Bnot listed5 GB (QLoRA)
Qwen Coder 7B7B8 GB (Runtime default)5 GB (QLoRA)
DeepSeek-R1 7B7B8 GB (Runtime default)5 GB (QLoRA)
Qwen2.5 7B Instruct7B8 GB (Runtime default)5 GB (QLoRA)
LLaVA 7B (Vision)7Bnot listed5 GB (QLoRA)
gte-Qwen2 7B7B16 GB (Runtime default)not listed
Qwen2.5-VL 7B7B7 GB (Runtime default)5 GB (QLoRA)
BakLLaVA 7B7B6 GB (Runtime default)5 GB (QLoRA)
BGE-M30.567Bnot listednot listed
Whisper Large v3 STT (LocalAI)—not listednot listed
Whisper Large v3 STT—6 GB (Runtime default)not listed

Sources and sizing assumptions

Kimi K2.6 MoE

DeepSeek V4 Pro

MiniMax M2

gpt-oss 120B

Read gpt-oss 120B requirements and sources

Llama 3.2 Vision 90B

Qwen2.5-VL 72B

Llama 3.3 70B

Read Llama 3.3 70B requirements and sources

LLaVA 34B

Qwen3 32B

Read Qwen3 32B requirements and sources

Qwen Coder 32B

DeepSeek-R1 32B

Qwen2.5 32B Instruct

Qwen2.5-VL 32B

MOVA 720p + audio (SGLang)

No sourced sizing row is recorded for this model.

Qwen3 30B A3B

Qwen3 Coder 30B

Read Qwen3 Coder 30B requirements and sources

Gemma 3 27B

Read Gemma 3 27B requirements and sources

Qwen3 Coder 27B

Mistral Small 24B

Devstral Small 24B

Mistral Small 3.1 24B (Vision)

gpt-oss 20B

Read gpt-oss 20B requirements and sources

Qwen3 14B

Read Qwen3 14B requirements and sources

Qwen2.5 Coder 14B

Phi-4 14B

DeepSeek-R1 14B

Qwen2.5 14B Instruct

Wan2.1 14B

LLaVA 13B

HunyuanVideo

Gemma 3 12B

Llama 3.2 Vision 11B

Qwen3 8B

Read Qwen3 8B requirements and sources

Granite 3.3 8B

Llama 3.1 8B

Read Llama 3.1 8B requirements and sources

DeepSeek-R1 8B

Qwen3 Coder 8B

Qwen3 Embedding 8B

MiniCPM-V 2.6 8B

LLaVA-Llama3 8B

Mistral 7B

Qwen Coder 7B

DeepSeek-R1 7B

Qwen2.5 7B Instruct

LLaVA 7B (Vision)

gte-Qwen2 7B

Qwen2.5-VL 7B

Read Qwen2.5-VL 7B requirements and sources

BakLLaVA 7B

BGE-M3

Read BGE-M3 requirements and sources

No sourced sizing row is recorded for this model.

Whisper Large v3 STT (LocalAI)

Read Whisper large-v3 requirements and sources

No sourced sizing row is recorded for this model.

Whisper Large v3 STT

Read Whisper large-v3 requirements and sources

Hardware · Machines