Index
Models
48 models across 11 families, with architecture pulled from each repository's config.
Llama
7 models · 1.2B–405.9B
Qwen
14 models · 600M–235.1B
Qwen3 235B-A22B
235.1B · 22.1B active · 94 layersQwen2.5 72B
72.7B · 80 layersQwen3 32B
32.8B · 64 layersQwen2.5 32B
32.8B · 64 layersQwen2.5-Coder 32B
32.8B · 64 layersQwen3 30B-A3B
30.5B · 3.3B active · 48 layersQwen3 14B
14.8B · 40 layersQwen2.5 14B
14.8B · 48 layersQwen3 8B
8.2B · 36 layersQwen2.5 7B
7.6B · 28 layersQwen2.5-Coder 7B
7.6B · 28 layersQwen3 4B
4.0B · 36 layersQwen3 1.7B
1.7B · 28 layersQwen3 0.6B
600M · 28 layers
235.1B · 22.1B active · 94 layersQwen2.5 72B
72.7B · 80 layersQwen3 32B
32.8B · 64 layersQwen2.5 32B
32.8B · 64 layersQwen2.5-Coder 32B
32.8B · 64 layersQwen3 30B-A3B
30.5B · 3.3B active · 48 layersQwen3 14B
14.8B · 40 layersQwen2.5 14B
14.8B · 48 layersQwen3 8B
8.2B · 36 layersQwen2.5 7B
7.6B · 28 layersQwen2.5-Coder 7B
7.6B · 28 layersQwen3 4B
4.0B · 36 layersQwen3 1.7B
1.7B · 28 layersQwen3 0.6B
600M · 28 layers
DeepSeek
5 models · 8.0B–671B
Gemma
6 models · 1B–27.4B
Mistral
7 models · 7.3B–140.6B
OpenAI
2 models · 20.9B–116.8B
Microsoft
2 models · 3.8B–14.7B
Cohere
2 models · 35.0B–103.8B
Zhipu
1 model · 9.4B
01.AI
1 model · 34.4B
HuggingFace
1 model · 1.7B