| Qwen 3.6 (27B, Q4) | 27B | Q4_K_M | 262K | Apache 2.0 | 17.0 GB | llama.cpp, MLX, Ollama | 20 |
| Qwen 3.6 (27B, Q8) | 27B | Q8_0 | 262K | Apache 2.0 | 29.0 GB | llama.cpp, MLX | 20 |
| Qwen 3.6 (35B-A3B, Q4) | 35B | Q4_K_M | 262K | Apache 2.0 | 21.2 GB | llama.cpp, MLX | 20 |
| Qwen 3.6 (35B-A3B, Q8) | 35B | Q8_0 | 262K | Apache 2.0 | 37.0 GB | llama.cpp, MLX | 20 |
| Gemma 4 (12B, Q4) | 12B | UD-Q4_K_XL | 256K | Apache 2.0 | 6.7 GB | llama.cpp, MLX | 15 |
| Gemma 4 (12B, Q8) | 12B | Q8_0 | 256K | Apache 2.0 | 12.7 GB | llama.cpp, MLX | 15 |
| Gemma 4 (26B, MoE, Q4) | 25.2B | UD-Q4_K_XL | 256K | Apache 2.0 | 14.2 GB | llama.cpp, MLX, Ollama | 15 |
| Gemma 4 (31B) | 30.7B | UD-Q4_K_XL | 256K | Apache 2.0 | 17.3 GB | llama.cpp, MLX, Ollama | 15 |
| Gemma 4 (E2B) | 2.3B | Q8_0 | 128K | Apache 2.0 | 5.0 GB | llama.cpp, MLX, Ollama | 15 |
| Gemma 4 (E4B) | 8B | Q8_0 | 128K | Apache 2.0 | 8.0 GB | llama.cpp, MLX, Ollama | 15 |
| Talkie 1930 (13B) | 13B | Q4_K_M | 2K | Apache 2.0 | 8.6 GB | llama.cpp | 5 |
| DeepSeek R1 (8B) | 8B | Q4_K_M | 128K | MIT | 5.2 GB | llama.cpp, MLX, Ollama | |
| DeepSeek V4 Flash (FP4) | 284B | FP4-FP8 | 1000K | MIT | 156.1 GB | llama.cpp, MLX | |
| DeepSeek V4 Flash (IQ2_XXS) | 284B | IQ2_XXS | 1000K | MIT | 86.7 GB | llama.cpp | |
| GLM 5.2 (IQ2_XXS) | 754B | | 1049K | MIT | 211.1 GB | | |
| GPT-OSS (120B, MoE) | 117B | Q4_K_M | 131K | Apache 2.0 | 65.0 GB | llama.cpp, MLX, Ollama | |
| GPT-OSS (20B, MoE) | 20B | Q4_K_M | 131K | Apache 2.0 | 12.0 GB | llama.cpp, MLX, Ollama | |
| Laguna S 2.1 (118B-A8B, Q4) | 118B | Q4_K_M | 262K | OpenMDW 1.1 | 75.2 GB | llama.cpp, MLX | |
| Laguna S 2.1 (118B-A8B, Q6 MLX) | 118B | oQ6e | 262K | OpenMDW 1.1 | 92.0 GB | MLX | |
| Laguna S 2.1 (118B-A8B, Q8) | 118B | Q8_0 | 262K | OpenMDW 1.1 | 128.0 GB | llama.cpp, MLX | |
| Llama 3.2 (3B) | 3B | Q4_K_M | 128K | Llama 3.2 Community | 2.0 GB | llama.cpp, MLX, Ollama | |
| Mistral 7B Instruct | 7B | Q4_K_M | 33K | Apache 2.0 | 4.4 GB | llama.cpp, MLX, Ollama | |
| Mistral Medium 3.5 (128B) | 128B | Q4_K_M | 262K | MIT-Modified | 74.9 GB | llama.cpp, MLX | |
| Nemotron-3 Nano (30B, MoE Reasoning) | 30B | Q4_K_M | 131K | NVIDIA Open Model | 24.5 GB | llama.cpp, MLX | |
| Nemotron-3 Super (120B-A12B) | 120B | Q4_K_M | 131K | NVIDIA Open Model | 86.1 GB | llama.cpp | |
| Ornith 1.0 (35B, Q4) | 35B | Q4_K_M | 262K | MIT | 21.2 GB | llama.cpp, MLX | |
| Ornith 1.0 (35B, Q8) | 35B | Q8_0 | 262K | MIT | 37.0 GB | llama.cpp, MLX | |
| Ornith 1.0 (9B) | 9B | Q4_K_M | 262K | MIT | 5.6 GB | llama.cpp, MLX | |
| Qwen 3.5 (122B-A10B, Q4) | 122B | Q4_K_M | 262K | Apache 2.0 | 77.0 GB | llama.cpp, MLX | |
| Qwen 3.5 (2B) | 2B | Q4_K_M | 256K | Apache 2.0 | 2.7 GB | llama.cpp, MLX, Ollama | |
| Qwen 3.5 (4B) | 4B | Q4_K_M | 256K | Apache 2.0 | 3.4 GB | llama.cpp, MLX, Ollama | |
| Qwen 3.5 (9B) | 9B | Q4_K_M | 262K | Apache 2.0 | 6.6 GB | llama.cpp, MLX, Ollama | |
| Ternary Bonsai 27B (2-bit) | 27B | 2bit | 262K | Apache 2.0 | 8.5 GB | MLX | |