The model index
All 105 open-weight models we track, grouped by size — because the first question is always whether it fits. Smallest VRAM footprint first within each tier.
Tiny under 3B
10Runs on almost anything — phones, a Raspberry Pi, any laptop.
Gemma 3 1B
1B
min 1.5 GB text generation multilingual summarization Qwen 3.5 0.8B
800M
min 1.5 GB text generation reasoning multilingual SmolLM2 1.7B
1.7B
min 1.9 GB text generation code generation summarization DeepSeek R1 1.5B
1.5B
min 2 GB text generation reasoning math Llama 3.2 1B
1B
min 2.1 GB text generation summarization Qwen 3 0.6B
600M
min 2.5 GB text generation reasoning multilingual Gemma 2 2B
2B
min 2.7 GB text generation code generation multilingual Qwen 3.5 2B
2B
min 3 GB text generation code generation reasoning Gemma 3n E2B
2B
min 3.3 GB text generation reasoning multilingual Gemma 4 E2B
2B
min 4 GB text generation reasoning multilingual Small 3–9B
30Comfortable on 8 GB GPUs and entry-level Macs.
Llama 3.2 3B
3B
min 3.3 GB text generation code generation multilingual StarCoder2 3B
3B
min 3.5 GB code generation text generation Phi-3 Mini 3.8B
3.8B
min 3.8 GB text generation code generation reasoning Gemma 3n E4B
4B
min 4.5 GB text generation reasoning multilingual Phi-4 Mini 3.8B
3.8B
min 4.5 GB text generation code generation reasoning Qwen 3 4B
4B
min 4.5 GB text generation code generation reasoning Qwen 3.5 4B
4B
min 4.5 GB text generation code generation reasoning Gemma 3 4B
4B
min 5 GB text generation code generation reasoning Yi 1.5 6B
6B
min 5 GB text generation code generation reasoning InternLM 2.5 7B
7B
min 5.5 GB text generation code generation reasoning StarCoder2 7B
7B
min 5.5 GB code generation text generation DeepSeek R1 7B
7B
min 5.7 GB text generation code generation reasoning Mistral 7B
7B
min 5.7 GB text generation code generation multilingual Qwen 2.5 7B
7B
min 5.7 GB text generation code generation multilingual Qwen 2.5 Coder 7B
7B
min 5.7 GB text generation code generation Dolphin 3 8B
8B
min 6 GB text generation code generation reasoning Gemma 4 E4B
4B
min 6 GB text generation code generation reasoning Granite 3.3 8B
8B
min 6 GB text generation code generation reasoning Nous Hermes 2 8B
8B
min 6 GB text generation code generation reasoning Llama 3.1 8B
8B
min 6.3 GB text generation code generation multilingual Aya Expanse 8B
8B
min 6.5 GB text generation multilingual creative writing Falcon 3 7B
7B
min 6.8 GB text generation code generation reasoning Codestral Mamba 7B
7B
min 6.9 GB code generation text generation OpenChat 3.5 7B
7B
min 6.9 GB text generation code generation reasoning WizardLM 2 7B
7B
min 6.9 GB text generation code generation reasoning Qwen 2.5 VL 7B
7B
min 7 GB text generation vision reasoning Cogito 8B
8B
min 7.5 GB text generation code generation reasoning DeepSeek R1 8B
8B
min 7.5 GB text generation code generation reasoning Nemotron 3 Nano 8B
8B
min 7.5 GB text generation code generation reasoning Qwen 3 8B
8B
min 7.5 GB text generation code generation reasoning Medium 9–32B
26Wants a 16–24 GB card or a 32 GB+ Mac.
Yi 1.5 9B
9B
min 6.5 GB text generation code generation reasoning Gemma 2 9B
9B
min 6.9 GB text generation code generation reasoning Qwen 3.5 9B
9B
min 7.5 GB text generation code generation reasoning Yi Coder 9B
9B
min 8 GB code generation text generation reasoning Falcon 3 10B
10B
min 8.5 GB text generation code generation reasoning Llama 3.2 Vision 11B
11B
min 8.5 GB text generation vision reasoning Mistral Nemo 12B
12B
min 9.5 GB text generation code generation reasoning DeepSeek R1 14B
14B
min 9.9 GB text generation code generation reasoning Phi-4 14B
14B
min 9.9 GB text generation code generation reasoning Qwen 2.5 14B
14B
min 9.9 GB text generation code generation reasoning Gemma 3 12B
12B
min 10.5 GB text generation code generation reasoning StarCoder2 15B
15B
min 10.5 GB text generation code generation Phi-4 Reasoning 14B
14B
min 11 GB text generation code generation reasoning InternLM 2.5 20B
20B
min 12 GB text generation code generation reasoning Qwen 2.5 Coder 14B
14B
min 12 GB text generation code generation Qwen 3 14B
14B
min 12 GB text generation code generation reasoning Codestral 22B
22B
min 14.7 GB text generation code generation Devstral 24B
24B
min 17 GB text generation code generation reasoning Magistral Small 24B
24B
min 17 GB text generation code generation reasoning Gemma 2 27B
27B
min 17.7 GB text generation code generation reasoning Mistral Small 3.1 24B
24B
min 18 GB text generation code generation reasoning Qwen 3.5 27B
27B
min 19 GB text generation code generation reasoning Gemma 3 27B
27B
min 20 GB text generation code generation reasoning Gemma 4 26B
26B
min 20 GB text generation code generation reasoning Gemma 4 31B
31B
min 22 GB text generation code generation reasoning Qwen 3 30B-A3B (MoE)
30B
min 22 GB text generation code generation reasoning Large 32–70B
14High-end GPUs (24–48 GB) or 64 GB+ unified memory.
Qwen 3.5 35B A3B
35B
min 12 GB text generation code generation reasoning Nous Hermes 2 34B
34B
min 19 GB text generation code generation reasoning DeepSeek R1 32B
32B
min 20.7 GB text generation code generation reasoning Qwen 2.5 32B
32B
min 20.7 GB text generation code generation reasoning Yi 1.5 34B
34B
min 21 GB text generation code generation reasoning Cogito 32B
32B
min 21.5 GB text generation code generation reasoning QwQ 32B
32B
min 21.5 GB text generation code generation reasoning Aya Expanse 32B
32B
min 22 GB text generation multilingual creative writing WizardCoder 33B
33B
min 22 GB code generation text generation reasoning Command R 35B
35B
min 22.5 GB text generation reasoning multilingual Qwen 2.5 Coder 32B
32B
min 23 GB text generation code generation reasoning Qwen 3 32B
32B
min 23 GB text generation code generation reasoning Dolphin Mixtral 8x7B
47B
min 26 GB text generation code generation reasoning Mixtral 8x7B
47B
min 29.7 GB text generation code generation reasoning Huge 70B and up
25Workstation territory — multi-GPU or 96 GB+ Macs. MoE models cheat the rules.
Qwen 2.5 VL 72B
72B
min 41 GB text generation vision reasoning Cogito 70B
70B
min 43 GB text generation code generation reasoning DeepSeek R1 70B
70B
min 43.5 GB text generation code generation reasoning Llama 3.1 70B
70B
min 43.5 GB text generation code generation reasoning Llama 3.3 70B
70B
min 43.5 GB text generation code generation reasoning Qwen 2.5 72B
72B
min 44.7 GB text generation code generation reasoning Llama 3.2 Vision 90B
90B
min 50 GB text generation vision reasoning Command R+ 104B
104B
min 57 GB text generation code generation reasoning Command A 111B
111B
min 61 GB text generation code generation reasoning Devstral 2 123B
123B
min 67 GB text generation code generation reasoning Mistral Large 2 123B
123B
min 67 GB text generation code generation reasoning Llama 4 Scout (109B/17B active)
109B
min 72 GB text generation code generation reasoning Qwen 3.5 122B
122B
min 85 GB text generation code generation reasoning Mixtral 8x22B
141B
min 86 GB text generation code generation reasoning Qwen 3 235B-A22B
235B
min 138 GB text generation code generation reasoning Nemotron Ultra 253B
253B
min 155 GB text generation code generation reasoning Llama 4 Maverick
400B
min 228 GB text generation code generation reasoning Llama 3.1 405B
405B
min 244.5 GB text generation code generation reasoning GLM-5
744B
min 300 GB text generation code generation reasoning GLM-5.1
754B
min 305 GB text generation code generation reasoning DeepSeek R1 671B
671B
min 362 GB text generation code generation reasoning DeepSeek V3-0324
671B
min 362 GB text generation code generation reasoning DeepSeek V3
671B
min 362 GB text generation code generation reasoning Kimi K2.5
1T
min 390 GB text generation code generation reasoning DeepSeek V3.2
671B
min 420 GB text generation code generation reasoning