Models

Manifests for models a gezel crew can run locally: verified file hashes, per-engine download blocks (llama.cpp, MLX, Ollama), honest size and context numbers, license classes, and tuned sampling defaults. Sorted by how strongly the catalog recommends them.

Chat models

ModelParamsQuantContextLicenseSizeEnginesReco
Qwen 3.6 (27B, Q4)27BQ4_K_M262KApache 2.017.0 GBllama.cpp, MLX, Ollama20
Qwen 3.6 (27B, Q8)27BQ8_0262KApache 2.029.0 GBllama.cpp, MLX20
Qwen 3.6 (35B-A3B, Q4)35BQ4_K_M262KApache 2.021.2 GBllama.cpp, MLX20
Qwen 3.6 (35B-A3B, Q8)35BQ8_0262KApache 2.037.0 GBllama.cpp, MLX20
Gemma 4 (12B, Q4)12BUD-Q4_K_XL256KApache 2.06.7 GBllama.cpp, MLX15
Gemma 4 (12B, Q8)12BQ8_0256KApache 2.012.7 GBllama.cpp, MLX15
Gemma 4 (26B, MoE, Q4)25.2BUD-Q4_K_XL256KApache 2.014.2 GBllama.cpp, MLX, Ollama15
Gemma 4 (31B)30.7BUD-Q4_K_XL256KApache 2.017.3 GBllama.cpp, MLX, Ollama15
Gemma 4 (E2B)2.3BQ8_0128KApache 2.05.0 GBllama.cpp, MLX, Ollama15
Gemma 4 (E4B)8BQ8_0128KApache 2.08.0 GBllama.cpp, MLX, Ollama15
Talkie 1930 (13B)13BQ4_K_M2KApache 2.08.6 GBllama.cpp5
DeepSeek R1 (8B)8BQ4_K_M128KMIT5.2 GBllama.cpp, MLX, Ollama
DeepSeek V4 Flash (FP4)284BFP4-FP81000KMIT156.1 GBllama.cpp, MLX
DeepSeek V4 Flash (IQ2_XXS)284BIQ2_XXS1000KMIT86.7 GBllama.cpp
GLM 5.2 (IQ2_XXS)754B1049KMIT211.1 GB
GPT-OSS (120B, MoE)117BQ4_K_M131KApache 2.065.0 GBllama.cpp, MLX, Ollama
GPT-OSS (20B, MoE)20BQ4_K_M131KApache 2.012.0 GBllama.cpp, MLX, Ollama
Laguna S 2.1 (118B-A8B, Q4)118BQ4_K_M262KOpenMDW 1.175.2 GBllama.cpp, MLX
Laguna S 2.1 (118B-A8B, Q6 MLX)118BoQ6e262KOpenMDW 1.192.0 GBMLX
Laguna S 2.1 (118B-A8B, Q8)118BQ8_0262KOpenMDW 1.1128.0 GBllama.cpp, MLX
Llama 3.2 (3B)3BQ4_K_M128KLlama 3.2 Community2.0 GBllama.cpp, MLX, Ollama
Mistral 7B Instruct7BQ4_K_M33KApache 2.04.4 GBllama.cpp, MLX, Ollama
Mistral Medium 3.5 (128B)128BQ4_K_M262KMIT-Modified74.9 GBllama.cpp, MLX
Nemotron-3 Nano (30B, MoE Reasoning)30BQ4_K_M131KNVIDIA Open Model24.5 GBllama.cpp, MLX
Nemotron-3 Super (120B-A12B)120BQ4_K_M131KNVIDIA Open Model86.1 GBllama.cpp
Ornith 1.0 (35B, Q4)35BQ4_K_M262KMIT21.2 GBllama.cpp, MLX
Ornith 1.0 (35B, Q8)35BQ8_0262KMIT37.0 GBllama.cpp, MLX
Ornith 1.0 (9B)9BQ4_K_M262KMIT5.6 GBllama.cpp, MLX
Qwen 3.5 (122B-A10B, Q4)122BQ4_K_M262KApache 2.077.0 GBllama.cpp, MLX
Qwen 3.5 (2B)2BQ4_K_M256KApache 2.02.7 GBllama.cpp, MLX, Ollama
Qwen 3.5 (4B)4BQ4_K_M256KApache 2.03.4 GBllama.cpp, MLX, Ollama
Qwen 3.5 (9B)9BQ4_K_M262KApache 2.06.6 GBllama.cpp, MLX, Ollama
Ternary Bonsai 27B (2-bit)27B2bit262KApache 2.08.5 GBMLX

Image models

ModelCategoryQuantLicenseSizeHardware
Animagine XL 4.0artisticFP16Fair AI 1.0-SD6.9 GBmid
FLUX.1 dev (Q4)generalQ4_K_SFLUX.1 dev6.8 GBhigh
FLUX.1 schnell (Q4)generalQ4_K_SApache 2.06.8 GBhigh
FLUX.2 Klein 4B (Q4)generalQ4_0Apache 2.02.5 GBhigh
Krea 2 Turbo (Q4)generalQ4_K_MKrea 2 Community7.5 GBhigh
Krea 2 Turbo (Q6)generalQ6_KKrea 2 Community10.6 GBworkstation
Krea 2 Turbo (Q8)generalQ8_0Krea 2 Community13.7 GBworkstation
SD-TurbogeneralFP16Stability Community5.2 GBlow
SDXL Lightning (4-step)generalFP16OpenRAIL++6.9 GBmid
SDXL TurbogeneralFP16Stability NC Research6.9 GBmid
Stable Diffusion 1.5generalFP16OpenRAIL-M4.3 GBlow
Stable Diffusion XL 1.0generalFP16OpenRAIL++-M6.9 GBmid

Video models

ModelFamilyFramesLicenseSizeHardware
LTX-2 (19B, video + audio)ltx2121LTX Open Weights92.1 GBhigh
LTX-Video 0.9.7 dev (13B)ltx97LTX Open Weights47.6 GBhigh
LTX-Video 0.9.8 distilled (13B)ltx97LTX Open Weights47.6 GBhigh
Wan 2.2 TI2V-5Bwan121Apache 2.034.2 GBhigh