quant-mind commited on
Commit
22be29b
·
verified ·
1 Parent(s): 5087d1b

Upload README.md with huggingface_hub

Browse files
Files changed (1) hide show
  1. README.md +13 -30
README.md CHANGED
@@ -2,41 +2,24 @@
2
  base_model: huihui-ai/Huihui-Nex-N2-mini-abliterated
3
  license: apache-2.0
4
  pipeline_tag: image-text-to-text
5
- tags:
6
- - gguf
7
- - llama.cpp
8
- - multimodal
9
- - vision
10
- - abliterated
11
- - uncensored
12
- - qwen3_5_moe
13
  ---
14
  # Huihui-Nex-N2-mini-abliterated-GGUF
15
 
16
- GGUF de [`huihui-ai/Huihui-Nex-N2-mini-abliterated`](https://huggingface.co/huihui-ai/Huihui-Nex-N2-mini-abliterated) (arch `qwen3_5_moe`, MoE ~35B, **multimodal**),
17
- convertido com `llama.cpp` (`convert_hf_to_gguf.py` + `llama-quantize`).
18
 
19
- ## Arquivos
20
- | Arquivo | Tamanho | Descrição |
21
- |---|---|---|
22
- | `Huihui-Nex-N2-mini-abliterated-Q4_K_M.gguf` | ~20 GB | LLM (texto) quantizado em **Q4_K_M** |
23
- | `mmproj-Huihui-Nex-N2-mini-abliterated-f16.gguf` | ~858 MB | **Projetor de visão** (mmproj, f16) — necessário para entrada de imagem |
24
 
25
- ## Uso (visão) com llama.cpp
26
- Os dois arquivos são necessários para multimodalidade. Exemplo:
 
 
 
 
 
27
 
 
28
  ```bash
29
- # servidor com suporte a imagem
30
- llama-server \
31
- -m Huihui-Nex-N2-mini-abliterated-Q4_K_M.gguf \
32
- --mmproj mmproj-Huihui-Nex-N2-mini-abliterated-f16.gguf \
33
- -c 8192 --host 0.0.0.0 --port 8080
34
-
35
- # CLI multimodal
36
- llama-mtmd-cli \
37
- -m Huihui-Nex-N2-mini-abliterated-Q4_K_M.gguf \
38
- --mmproj mmproj-Huihui-Nex-N2-mini-abliterated-f16.gguf \
39
- --image foto.jpg -p "Descreva a imagem."
40
  ```
41
-
42
- > Requer um build recente do llama.cpp (suporte a `qwen3_5_moe` + torre de visão Qwen3-VL).
 
2
  base_model: huihui-ai/Huihui-Nex-N2-mini-abliterated
3
  license: apache-2.0
4
  pipeline_tag: image-text-to-text
5
+ tags: [gguf, llama.cpp, multimodal, vision, abliterated, qwen3_5_moe, imatrix]
 
 
 
 
 
 
 
6
  ---
7
  # Huihui-Nex-N2-mini-abliterated-GGUF
8
 
9
+ GGUF de [`huihui-ai/Huihui-Nex-N2-mini-abliterated`](https://huggingface.co/huihui-ai/Huihui-Nex-N2-mini-abliterated) (arch `qwen3_5_moe`, MoE ~35B, **multimodal**), via `llama.cpp`.
 
10
 
11
+ > Conversao corrigida: o `block_count` (camada MTP/nextn fantasma) foi ajustado de 41 para 40 para o modelo carregar.
 
 
 
 
12
 
13
+ ## Arquivos
14
+ | Arquivo | O que e |
15
+ |---|---|
16
+ | `Huihui-Nex-N2-mini-abliterated-UD-Q4_K_XL.gguf` | LLM texto **Q4_K_M + imatrix** (din., estilo Unsloth UD) |
17
+ | `Huihui-Nex-N2-mini-abliterated-Q4_K_M.gguf` | LLM texto Q4_K_M padrao |
18
+ | `mmproj-Huihui-Nex-N2-mini-abliterated-f16.gguf` | **Projetor de visao** (necessario p/ imagem) |
19
+ | `imatrix-Huihui-Nex-N2-mini-abliterated.dat` | importance matrix (calibration_datav3) |
20
 
21
+ ## Uso (visao)
22
  ```bash
23
+ llama-server -m Huihui-Nex-N2-mini-abliterated-UD-Q4_K_XL.gguf \
24
+ --mmproj mmproj-Huihui-Nex-N2-mini-abliterated-f16.gguf -c 8192
 
 
 
 
 
 
 
 
 
25
  ```