quant-mind's picture
Upload README.md with huggingface_hub
051f07b verified
|
Raw
History Blame
1.37 kB
metadata
base_model: huihui-ai/Huihui-Nex-N2-mini-abliterated
license: apache-2.0
pipeline_tag: image-text-to-text
tags:
  - gguf
  - llama.cpp
  - multimodal
  - vision
  - abliterated
  - uncensored
  - qwen3_5_moe

Huihui-Nex-N2-mini-abliterated-GGUF

GGUF de huihui-ai/Huihui-Nex-N2-mini-abliterated (arch qwen3_5_moe, MoE ~35B, multimodal), convertido com llama.cpp (convert_hf_to_gguf.py + llama-quantize).

Arquivos

Arquivo Tamanho Descrição
Huihui-Nex-N2-mini-abliterated-Q4_K_M.gguf ~20 GB LLM (texto) quantizado em Q4_K_M
mmproj-Huihui-Nex-N2-mini-abliterated-f16.gguf ~858 MB Projetor de visão (mmproj, f16) — necessário para entrada de imagem

Uso (visão) com llama.cpp

Os dois arquivos são necessários para multimodalidade. Exemplo:

# servidor com suporte a imagem
llama-server \
  -m Huihui-Nex-N2-mini-abliterated-Q4_K_M.gguf \
  --mmproj mmproj-Huihui-Nex-N2-mini-abliterated-f16.gguf \
  -c 8192 --host 0.0.0.0 --port 8080

# CLI multimodal
llama-mtmd-cli \
  -m Huihui-Nex-N2-mini-abliterated-Q4_K_M.gguf \
  --mmproj mmproj-Huihui-Nex-N2-mini-abliterated-f16.gguf \
  --image foto.jpg -p "Descreva a imagem."

Requer um build recente do llama.cpp (suporte a qwen3_5_moe + torre de visão Qwen3-VL).