Skip to content

Qwen 3 0.6B

Apache 2.0

Alibaba · 0.6B · transformer-decoder

2025-04-2933K context0.6B params

Use Cases

chatreasoningmultilingual

Quantization Options

QuantBitsVRAMQualityStatus
Q4_K_Mrec42.5 GBGood
Q8_082.7 GBGood
F16163.3 GBExcellent

About this model

Qwen 3 0.6B is the smallest model in Alibaba's Qwen 3 family, designed for ultra-lightweight deployment on resource-constrained devices. Despite its compact size, it supports reasoning and multilingual capabilities with a 32K context window. This model is ideal for edge deployment, mobile devices, and scenarios where minimal VRAM and fast inference are priorities. It can run comfortably on virtually any modern GPU or Apple Silicon Mac.