Models

Manifests for models a gezel crew can run locally: verified file hashes, per-engine download blocks (llama.cpp, MLX, Ollama), honest size and context numbers, license classes, and tuned sampling defaults. Sorted by how strongly the catalog recommends them.

Chat models

ModelParamsQuantContextLicenseSizeEnginesReco
Qwen 3.6 (27B, Q4)27BQ4_K_M262KApache 2.017.1 GBllama.cpp, MLX, Ollama20
Qwen 3.6 (27B, Q8)27BQ8_0262KApache 2.029.0 GBllama.cpp, MLX20
Qwen 3.6 (35B-A3B, Q4)35BUD-Q4_K_M262KApache 2.022.7 GBllama.cpp, MLX20
Qwen 3.6 (35B-A3B, Q8)35BQ8_0262KApache 2.037.8 GBllama.cpp, MLX20
Qwen 3.8 (27B, IQ1_S)27BUD-IQ1_S262KApache 2.06.2 GBllama.cpp20
Qwen 3.8 (27B, Q2)27BUD-Q2_K_XL262KApache 2.09.8 GBllama.cpp20
Qwen 3.8 (27B, Q3)27BUD-Q3_K_XL262KApache 2.013.1 GBllama.cpp20
Qwen 3.8 (27B, Q4)27BUD-Q4_K_M262KApache 2.016.5 GBllama.cpp, MLX20
Qwen 3.8 (27B, Q6)27BUD-Q6_K262KApache 2.022.0 GBllama.cpp, MLX20
Qwen 3.8 (27B, Q8)27BQ8_0262KApache 2.029.0 GBllama.cpp, MLX20
Gemma 4 (12B, Q4)12BUD-Q4_K_XL256KApache 2.06.7 GBllama.cpp, MLX15
Gemma 4 (12B, Q8)12BQ8_0256KApache 2.012.7 GBllama.cpp, MLX15
Gemma 4 (26B, MoE, Q4)25.2BUD-Q4_K_XL256KApache 2.014.2 GBllama.cpp, MLX, Ollama15
Gemma 4 (31B, Q4)30.7BUD-Q4_K_XL256KApache 2.017.3 GBllama.cpp, MLX, Ollama15
Gemma 4 (E2B, Q4)2.3BUD-Q4_K_XL128KApache 2.02.6 GBllama.cpp, MLX, Ollama15
Gemma 4 (E4B, Q4)8BUD-Q4_K_XL128KApache 2.04.2 GBllama.cpp, MLX, Ollama15
BTL-4 (35B-A3B, Q4)35BQ4_K_M262KApache 2.021.4 GBllama.cpp10
BTL-4 Compact (35B-A3B, IQ2_XXS)35BIQ2_XXS262KApache 2.010.0 GBllama.cpp10
DeepSeek R1 (8B, Q4)8BQ4_K_M128KMIT5.2 GBllama.cpp, MLX, Ollama
DeepSeek V4 Flash (FP4)284BFP4-FP81000KMIT164.6 GBllama.cpp, MLX
DeepSeek V4 Flash (IQ2_XXS)284BIQ2_XXS1000KMIT86.7 GBllama.cpp
DeepSeek V4 Flash (mixed 2/4-bit)284BIQ2_XXS/Q4_K1000KMIT97.6 GBllama.cpp
DeepSeek V4 Flash (MXFP4)284BMXFP41000KMIT156.0 GBllama.cpp
GLM 5.2 (IQ2_XXS)754B1049KMIT211.1 GB
GLM 5.3 Flash (320B-A18B, IQ2_XXS)320B1049KMIT97.6 GB
GPT-OSS (120B, MoE, Q4)117BQ4_K_M131KApache 2.065.0 GBllama.cpp, MLX, Ollama
GPT-OSS (20B, MoE, Q4)20BQ4_K_M131KApache 2.012.0 GBllama.cpp, MLX, Ollama
Granite 4.2 (30B, Q4)30BQ4_K_M131KApache 2.017.7 GBllama.cpp, MLX
Granite 4.2 (3B, Q4)3BQ4_K_M131KApache 2.02.2 GBllama.cpp, MLX
Granite 4.2 (8B, Q4)8BQ4_K_M131KApache 2.05.3 GBllama.cpp, MLX
Laguna S 2.1 (118B-A8B, Q4)118BQ4_K_M262KOpenMDW 1.196.0 GBllama.cpp, MLX
Laguna S 2.1 (118B-A8B, Q6 MLX)118BoQ6e262KOpenMDW 1.192.0 GBMLX
Laguna S 2.1 (118B-A8B, Q8)118BQ8_0262KOpenMDW 1.1128.8 GBllama.cpp, MLX
LFM2.5 (2.6B, Q4)2.6BQ4_K_M128KLFM Open 1.01.7 GBllama.cpp, MLX
Llama 3.2 (3B, Q4)3BQ4_K_M128KLlama 3.2 Community2.0 GBllama.cpp, MLX, Ollama
Mistral 7B Instruct (Q4)7BQ4_K_M33KApache 2.04.4 GBllama.cpp, MLX, Ollama
Mistral Medium 3.5 (128B, Q4)128BQ4_K_M262KMIT-Modified74.9 GBllama.cpp, MLX
Muse Glimmer (30B, Q4)30BQ4_K_M131KApache 2.016.8 GBllama.cpp
Nanbeige 4.2 (3B, Q4)3BQ4_K_M262KApache 2.02.7 GBllama.cpp
Nemotron 3.5 Lightning (30B-A3B, Q4)30BQ4_K_M262KOpenMDW 1.125.4 GBllama.cpp, MLX
Nemotron 3.5 Lightning (30B-A3B, Q8)30BQ8_0262KOpenMDW 1.135.0 GBllama.cpp, MLX
Nemotron-3 Nano (30B, MoE Reasoning, Q4)30BQ4_K_M131KNVIDIA Open Model24.5 GBllama.cpp, MLX
Nemotron-3 Super (120B-A12B, Q4)120BQ4_K_M131KNVIDIA Open Model86.1 GBllama.cpp
Ornith 1.0 (35B, Q4)35BQ4_K_M262KMIT21.2 GBllama.cpp, MLX
Ornith 1.0 (35B, Q8)35BQ8_0262KMIT37.0 GBllama.cpp, MLX
Ornith 1.0 (9B, Q4)9BQ4_K_M262KMIT5.6 GBllama.cpp, MLX
Ornith 1.5 (35B-A3B, Q4)35BQ4_K_M262KMIT21.7 GBllama.cpp, MLX
Ornith 1.5 (35B-A3B, Q8)35BQ8_0262KMIT36.9 GBllama.cpp, MLX
Ornith 1.5 (9B, Q4)9BQ4_K_M262KMIT5.6 GBllama.cpp, MLX
Ornith 1.5 (9B, Q8)9BQ8_0262KMIT9.5 GBllama.cpp, MLX
Qwen 3.5 (122B-A10B, Q4)122BUD-Q4_K_M262KApache 2.078.3 GBllama.cpp, MLX
Qwen 3.5 (27B, Q4)27BQ4_K_M262KApache 2.017.1 GBllama.cpp, MLX, Ollama
Qwen 3.5 (2B, Q4)2BQ4_K_M256KApache 2.01.3 GBllama.cpp, MLX, Ollama
Qwen 3.5 (4B, Q4)4BQ4_K_M256KApache 2.02.8 GBllama.cpp, MLX, Ollama
Qwen 3.5 (9B, Q4)9BQ4_K_M262KApache 2.05.9 GBllama.cpp, MLX, Ollama
Qwen 3.8 Flash Next (180B-A6B, IQ3_XXS)180BUD-IQ3_XXS262KQwen Community 1.082.0 GBllama.cpp
Qwen 3.8 Flash Next (180B-A6B, IQ4_XS)180BUD-IQ4_XS262KQwen Community 1.093.7 GBllama.cpp
Talkie 1930 (13B, Q4)13BQ4_K_M2KApache 2.08.6 GBllama.cpp
Ternary Bonsai 27B (2-bit)27B2bit262KApache 2.08.5 GBMLX

Image models

ModelCategoryQuantLicenseSizeHardware
Animagine XL 4.0artisticFP16Fair AI 1.0-SD6.9 GBmid
FLUX.1 dev (Q4)generalQ4_K_SFLUX.1 dev6.8 GBhigh
FLUX.1 schnell (Q4)generalQ4_K_SApache 2.06.8 GBhigh
FLUX.2 Klein 4B (Q4)generalQ4_0Apache 2.02.5 GBhigh
Krea 2 Turbo (Q4)generalQ4_K_MKrea 2 Community7.5 GBhigh
Krea 2 Turbo (Q6)generalQ6_KKrea 2 Community10.6 GBworkstation
Krea 2 Turbo (Q8)generalQ8_0Krea 2 Community13.7 GBworkstation
SD-TurbogeneralFP16Stability Community5.2 GBlow
SDXL Lightning (4-step)generalFP16OpenRAIL++6.9 GBmid
SDXL TurbogeneralFP16Stability NC Research6.9 GBmid
Stable Diffusion 1.5generalFP16OpenRAIL-M4.3 GBlow
Stable Diffusion XL 1.0generalFP16OpenRAIL++-M6.9 GBmid

Video models

ModelFamilyFramesLicenseSizeHardware
LTX-2 (19B, video + audio)ltx2121LTX Open Weights92.1 GBhigh
LTX-Video 0.9.7 dev (13B)ltx97LTX Open Weights47.6 GBhigh
LTX-Video 0.9.8 distilled (13B)ltx97LTX Open Weights47.6 GBhigh
Wan 2.2 TI2V-5Bwan121Apache 2.034.2 GBhigh