sphaela commited on
Commit
4bd9a6a
·
verified ·
1 Parent(s): 6b210f6

Update README.md

Browse files

Add description for mixed quant based on discussion reported result.

Files changed (1) hide show
  1. README.md +1 -1
README.md CHANGED
@@ -24,7 +24,7 @@ The models were quantized using various schemes provided by the `auto-round` too
24
  | File Name | Quant Type | Size | Description |
25
  |-----------|------------|------|-------------|
26
  | `Qwen3.6-27B-Q2_K_S.gguf` | Q2_K_S | 8.9 GB | Extremely high compression, significant quality loss. |
27
- | `Qwen3.6-27B-Q2_K_MIXED.gguf` | Q2_K_MIXED | 16 GB | **Recommended** high-compression option. Uses Q4 for KV cache with good quality. |
28
  | `Qwen3.6-27B-Q3_K_S.gguf` | Q3_K_S | 12 GB | Very high compression, notable quality loss. |
29
  | `Qwen3.6-27B-Q3_K_M.gguf` | Q3_K_M | 12 GB | Balanced 3-bit quantization. |
30
  | `Qwen3.6-27B-Q3_K_L.gguf` | Q3_K_L | 12 GB | High quality 3-bit quantization. |
 
24
  | File Name | Quant Type | Size | Description |
25
  |-----------|------------|------|-------------|
26
  | `Qwen3.6-27B-Q2_K_S.gguf` | Q2_K_S | 8.9 GB | Extremely high compression, significant quality loss. |
27
+ | `Qwen3.6-27B-Q2_K_MIXED.gguf` | Q2_K_MIXED | 16 GB | **Recommended** high-compression option. Uses Q4 for KV cache with good quality. *Fast inference*.|
28
  | `Qwen3.6-27B-Q3_K_S.gguf` | Q3_K_S | 12 GB | Very high compression, notable quality loss. |
29
  | `Qwen3.6-27B-Q3_K_M.gguf` | Q3_K_M | 12 GB | Balanced 3-bit quantization. |
30
  | `Qwen3.6-27B-Q3_K_L.gguf` | Q3_K_L | 12 GB | High quality 3-bit quantization. |