Skip to content

The model index

All 105 open-weight models we track, grouped by size — because the first question is always whether it fits. Smallest VRAM footprint first within each tier.

Tiny under 3B

10

Runs on almost anything — phones, a Raspberry Pi, any laptop.

Small 3–9B

30

Comfortable on 8 GB GPUs and entry-level Macs.

Llama 3.2 3B
3B text generation code generation multilingual
StarCoder2 3B
3B code generation text generation
Phi-3 Mini 3.8B
3.8B text generation code generation reasoning
Gemma 3n E4B
4B text generation reasoning multilingual
Phi-4 Mini 3.8B
3.8B text generation code generation reasoning
Qwen 3 4B
4B text generation code generation reasoning
Qwen 3.5 4B
4B text generation code generation reasoning
Gemma 3 4B
4B text generation code generation reasoning
Yi 1.5 6B
6B text generation code generation reasoning
InternLM 2.5 7B
7B text generation code generation reasoning
StarCoder2 7B
7B code generation text generation
DeepSeek R1 7B
7B text generation code generation reasoning
Mistral 7B
7B text generation code generation multilingual
Qwen 2.5 7B
7B text generation code generation multilingual
Qwen 2.5 Coder 7B
7B text generation code generation
Dolphin 3 8B
8B text generation code generation reasoning
Gemma 4 E4B
4B text generation code generation reasoning
Granite 3.3 8B
8B text generation code generation reasoning
Nous Hermes 2 8B
8B text generation code generation reasoning
Llama 3.1 8B
8B text generation code generation multilingual
Aya Expanse 8B
8B text generation multilingual creative writing
Falcon 3 7B
7B text generation code generation reasoning
Codestral Mamba 7B
7B code generation text generation
OpenChat 3.5 7B
7B text generation code generation reasoning
WizardLM 2 7B
7B text generation code generation reasoning
Qwen 2.5 VL 7B
7B text generation vision reasoning
Cogito 8B
8B text generation code generation reasoning
DeepSeek R1 8B
8B text generation code generation reasoning
Nemotron 3 Nano 8B
8B text generation code generation reasoning
Qwen 3 8B
8B text generation code generation reasoning

Medium 9–32B

26

Wants a 16–24 GB card or a 32 GB+ Mac.

Yi 1.5 9B
9B text generation code generation reasoning
Gemma 2 9B
9B text generation code generation reasoning
Qwen 3.5 9B
9B text generation code generation reasoning
Yi Coder 9B
9B code generation text generation reasoning
Falcon 3 10B
10B text generation code generation reasoning
Llama 3.2 Vision 11B
11B text generation vision reasoning
Mistral Nemo 12B
12B text generation code generation reasoning
DeepSeek R1 14B
14B text generation code generation reasoning
Phi-4 14B
14B text generation code generation reasoning
Qwen 2.5 14B
14B text generation code generation reasoning
Gemma 3 12B
12B text generation code generation reasoning
StarCoder2 15B
15B text generation code generation
Phi-4 Reasoning 14B
14B text generation code generation reasoning
InternLM 2.5 20B
20B text generation code generation reasoning
Qwen 2.5 Coder 14B
14B text generation code generation
Qwen 3 14B
14B text generation code generation reasoning
Codestral 22B
22B text generation code generation
Devstral 24B
24B text generation code generation reasoning
Magistral Small 24B
24B text generation code generation reasoning
Gemma 2 27B
27B text generation code generation reasoning
Mistral Small 3.1 24B
24B text generation code generation reasoning
Qwen 3.5 27B
27B text generation code generation reasoning
Gemma 3 27B
27B text generation code generation reasoning
Gemma 4 26B
26B text generation code generation reasoning
Gemma 4 31B
31B text generation code generation reasoning
Qwen 3 30B-A3B (MoE)
30B text generation code generation reasoning

Large 32–70B

14

High-end GPUs (24–48 GB) or 64 GB+ unified memory.

Huge 70B and up

25

Workstation territory — multi-GPU or 96 GB+ Macs. MoE models cheat the rules.

Qwen 2.5 VL 72B
72B text generation vision reasoning
Cogito 70B
70B text generation code generation reasoning
DeepSeek R1 70B
70B text generation code generation reasoning
Llama 3.1 70B
70B text generation code generation reasoning
Llama 3.3 70B
70B text generation code generation reasoning
Qwen 2.5 72B
72B text generation code generation reasoning
Llama 3.2 Vision 90B
90B text generation vision reasoning
Command R+ 104B
104B text generation code generation reasoning
Command A 111B
111B text generation code generation reasoning
Devstral 2 123B
123B text generation code generation reasoning
Mistral Large 2 123B
123B text generation code generation reasoning
Llama 4 Scout (109B/17B active)
109B text generation code generation reasoning
Qwen 3.5 122B
122B text generation code generation reasoning
Mixtral 8x22B
141B text generation code generation reasoning
Qwen 3 235B-A22B
235B text generation code generation reasoning
Nemotron Ultra 253B
253B text generation code generation reasoning
Llama 4 Maverick
400B text generation code generation reasoning
Llama 3.1 405B
405B text generation code generation reasoning
GLM-5
744B text generation code generation reasoning
GLM-5.1
754B text generation code generation reasoning
DeepSeek R1 671B
671B text generation code generation reasoning
DeepSeek V3-0324
671B text generation code generation reasoning
DeepSeek V3
671B text generation code generation reasoning
Kimi K2.5
1T text generation code generation reasoning
DeepSeek V3.2
671B text generation code generation reasoning