LLM VRAM Calculator
Estimate how much VRAM a local model needs at each quantization, then see which of 20 GPUs can hold it.
Popular models
All 30 modelsTotal VRAM in GB at 8K context. Static table, readable without JavaScript.
| Model | Parameters | Q4_K_M | Q8_0 | FP16 |
|---|---|---|---|---|
| Gemma 4Parameters 31.27B · Q8_0 33.04 | 31.27B | 18.48 | 33.04 | 60.34 |
| gpt-oss-120bParameters 116.8B · Q8_0 116.9 | 116.8B | 62.49 | 116.9 | 218.9 |
| gpt-oss-20bParameters 20.91B · Q8_0 21.89 | 20.91B | 12.15 | 21.89 | 40.15 |
| Kimi K2Parameters 1026.4B · Q8_0 1017.2 | 1026.4B | 539.2 | 1017.2 | 1913.4 |
| DeepSeek R1Parameters 684.5B · Q8_0 678.9 | 684.5B | 360.1 | 678.9 | 1276.5 |
| Llama 3.3 70BParameters 70.55B · Q8_0 73.32 | 70.55B | 40.46 | 73.32 | 134.9 |
| Llama 3.1 8BParameters 8.03B · Q8_0 9.95 | 8.03B | 6.21 | 9.95 | 16.96 |
| Llama 3.1 70BParameters 70.55B · Q8_0 73.32 | 70.55B | 40.46 | 73.32 | 134.9 |
| DeepSeek V3Parameters 684.5B · Q8_0 678.9 | 684.5B | 360.1 | 678.9 | 1276.6 |
| Llama 3 8BParameters 8.03B · Q8_0 9.95 | 8.03B | 6.21 | 9.95 | 16.96 |