Skip to content

Best AI Models for 12 GB VRAM

The minimum for a good experience — 8B at Q8 or 14B models at Q4. Here are all 53 models you can run locally with 12 GB of memory.

Hardware with 12 GB Memory

Runs Comfortably (38)

These models fit with room to spare for context window and OS overhead.

ModelParamsQuantizationVRAMQuality
Mistral Nemo 12B12BQ4_K_M9.5 GB4
Llama 3.2 Vision 11B11BQ4_K_M8.5 GB4
Falcon 3 10B10BQ4_K_M8.5 GB4
Qwen 3.5 9B9BQ4_K_M7.5 GB4
Yi Coder 9B9BQ4_K_M8 GB4
DeepSeek R1 8B8BQ4_K_M7.5 GB4
Dolphin 3 8B8BQ8_010 GB5
Granite 3.3 8B8BQ8_010 GB4
Llama 3.1 8B8BQ8_010 GB4
Nous Hermes 2 8B8BQ8_010 GB5
Qwen 3 8B8BQ4_K_M7.5 GB4
Codestral Mamba 7B7BQ8_09.9 GB5
DeepSeek R1 7B7BQ8_09 GB4
Falcon 3 7B7BQ8_010 GB4
InternLM 2.5 7B7BQ8_09 GB5
Mistral 7B7BQ8_09 GB4
OpenChat 3.5 7B7BQ8_09.9 GB5
Qwen 2.5 7B7BQ8_09 GB4
Qwen 2.5 Coder 7B7BQ8_09 GB4
StarCoder2 7B7BQ8_09 GB5
WizardLM 2 7B7BQ8_09.9 GB5
Yi 1.5 6B6BQ8_08 GB5
Gemma 3 4B4BQ8_07.5 GB4
Gemma 4 E4B4BQ8_010 GB5
Qwen 3.5 4B4BQ8_06.5 GB4
Phi-3 Mini 3.8B3.8BF169.6 GB5
Llama 3.2 3B3BF168 GB5
StarCoder2 3B3BF168 GB5
Gemma 2 2B2BF166 GB5
Gemma 3n E2B2BF166.5 GB5
Gemma 4 E2B2BQ8_06 GB5
Qwen 3.5 2B2BQ8_04.5 GB4
SmolLM2 1.7B1.7BF164.4 GB5
DeepSeek R1 1.5B1.5BF165 GB5
Gemma 3 1B1BF163.5 GB5
Llama 3.2 1B1BF164 GB5
Qwen 3.5 0.8B0.8BQ8_02 GB4
Qwen 3 0.6B0.6BF163.3 GB5

Tight Fit (15)

These models run but with limited context window. Close other apps to free memory.

ModelParamsQuantizationVRAMQuality
StarCoder2 15B15BQ4_K_M10.5 GB3
DeepSeek R1 14B14BQ5_K_M11.3 GB4
Phi-4 14B14BQ5_K_M11.3 GB4
Phi-4 Reasoning 14B14BQ4_K_M11 GB4
Qwen 2.5 14B14BQ5_K_M11.3 GB4
Gemma 3 12B12BQ4_K_M10.5 GB4
Gemma 2 9B9BQ8_011 GB4
Yi 1.5 9B9BQ8_011 GB5
Aya Expanse 8B8BQ8_010.5 GB5
Cogito 8B8BQ8_011 GB4
Nemotron 3 Nano 8B8BQ8_011 GB4
Qwen 2.5 VL 7B7BQ8_010.5 GB4
Gemma 3n E4B4BF1611 GB5
Qwen 3 4B4BF1611 GB5
Phi-4 Mini 3.8B3.8BF1610.5 GB5

Want to check a specific combination?

Use the compatibility checker to see exactly how a model runs on your specific hardware, with performance estimates.

Open Compatibility Checker
8 GBEntry-level local AI 16 GBThe sweet spot 24 GBSerious local AI 32 GBPremium tier