Qwen3.6 28B REAP20 A3B — GGUF Quantizations GGUF quantizations of 0xSero/Qwen3.6 28B REAP20 A3B, a 20% expert pruned variant of Qwen/Qwen3.6 35B A3B using the REAP (Router weighted Expert Activation Pruning) method. Available Files File Quant Size BPW Description Qwen3.6 28B REAP20 A3B BF16.gguf BF16 ~56.5 GB 16.0 Full precision, for re quantization Qwen3.6 28B REAP20 A3B Q8 0.gguf Q8 0 ~30 GB 8.0 Near lossless, large file Qwen3.6 28B REAP20 A3B Q6 K.gguf Q6 K ~23 GB 6.56 Near lossless, recommended for high quality Qwen3.6 28B REAP20 A3B Q5 K M.gguf Q5 K M ~20 GB 5.68 High quality, larger size Qwen3.6 28B REAP20 A3B Q5 K S.gguf Q5 K S ~19 GB 5.52 High quality, slightly smaller Qwen3.6 28B REAP20 A3B Q4 K M.gguf Q4 K M ~17 GB 4.89 Recommended — best quality/size balance Qwen3.6 28B REAP20 A3B Q4 K S.gguf Q4 K S ~16 GB 4.63 4 bit small Qwen3.6 28B REAP20 A3B Q3 K L.gguf Q3 K L ~15 GB 4.27 3 bit large Qwen3.6 28B REAP20 A3B Q3 K M.gguf Q3 K M ~14 GB 3.91 3 bit medium Qwen3.6 28B REAP20 A3B Q3 K S.gguf Q3 K S ~13 GB 3.66 3 bit small Qwen3.6 28B REAP20 A3B IQ3 XXS.gguf IQ3 XXS ~12 GB 3.06 Ultra small, imatrix based Qwen3.6 28B REAP20 A3B Q2 K.gguf Q2 K ~11 GB 2.96 Smallest size, lowest…
We use cookies for essential functionality and analytics. You can accept or reject analytics cookies.Cookie policy