quant-mind's picture
Upload README.md with huggingface_hub
22be29b verified
|
Raw
History Blame Contribute Delete
1.12 kB
metadata
base_model: huihui-ai/Huihui-Nex-N2-mini-abliterated
license: apache-2.0
pipeline_tag: image-text-to-text
tags:
  - gguf
  - llama.cpp
  - multimodal
  - vision
  - abliterated
  - qwen3_5_moe
  - imatrix

Huihui-Nex-N2-mini-abliterated-GGUF

GGUF de huihui-ai/Huihui-Nex-N2-mini-abliterated (arch qwen3_5_moe, MoE ~35B, multimodal), via llama.cpp.

Conversao corrigida: o block_count (camada MTP/nextn fantasma) foi ajustado de 41 para 40 para o modelo carregar.

Arquivos

Arquivo O que e
Huihui-Nex-N2-mini-abliterated-UD-Q4_K_XL.gguf LLM texto Q4_K_M + imatrix (din., estilo Unsloth UD)
Huihui-Nex-N2-mini-abliterated-Q4_K_M.gguf LLM texto Q4_K_M padrao
mmproj-Huihui-Nex-N2-mini-abliterated-f16.gguf Projetor de visao (necessario p/ imagem)
imatrix-Huihui-Nex-N2-mini-abliterated.dat importance matrix (calibration_datav3)

Uso (visao)

llama-server -m Huihui-Nex-N2-mini-abliterated-UD-Q4_K_XL.gguf \
  --mmproj mmproj-Huihui-Nex-N2-mini-abliterated-f16.gguf -c 8192