--- base_model: huihui-ai/Huihui-Nex-N2-mini-abliterated license: apache-2.0 pipeline_tag: image-text-to-text tags: - gguf - llama.cpp - multimodal - vision - abliterated - uncensored - qwen3_5_moe --- # Huihui-Nex-N2-mini-abliterated-GGUF GGUF de [`huihui-ai/Huihui-Nex-N2-mini-abliterated`](https://huggingface.co/huihui-ai/Huihui-Nex-N2-mini-abliterated) (arch `qwen3_5_moe`, MoE ~35B, **multimodal**), convertido com `llama.cpp` (`convert_hf_to_gguf.py` + `llama-quantize`). ## Arquivos | Arquivo | Tamanho | Descrição | |---|---|---| | `Huihui-Nex-N2-mini-abliterated-Q4_K_M.gguf` | ~20 GB | LLM (texto) quantizado em **Q4_K_M** | | `mmproj-Huihui-Nex-N2-mini-abliterated-f16.gguf` | ~858 MB | **Projetor de visão** (mmproj, f16) — necessário para entrada de imagem | ## Uso (visão) com llama.cpp Os dois arquivos são necessários para multimodalidade. Exemplo: ```bash # servidor com suporte a imagem llama-server \ -m Huihui-Nex-N2-mini-abliterated-Q4_K_M.gguf \ --mmproj mmproj-Huihui-Nex-N2-mini-abliterated-f16.gguf \ -c 8192 --host 0.0.0.0 --port 8080 # CLI multimodal llama-mtmd-cli \ -m Huihui-Nex-N2-mini-abliterated-Q4_K_M.gguf \ --mmproj mmproj-Huihui-Nex-N2-mini-abliterated-f16.gguf \ --image foto.jpg -p "Descreva a imagem." ``` > Requer um build recente do llama.cpp (suporte a `qwen3_5_moe` + torre de visão Qwen3-VL).