Llama.cpp Quantization of Wingless_Imp_8B_Abliterated by SicariusSicariiStuff

Using llama.cpp release b8914 for quantization.

Original model: SicariusSicariiStuff/Wingless_Imp_8B_Abliterated

Download a file (not the whole branch) from below:

Filename Quant type File Size Description
SicariusSicariiStuff_Wingless_Imp_8B_Abliterated-GGUF-Q8_0.gguf Q8_0 8.54GB High quality.
SicariusSicariiStuff_Wingless_Imp_8B_Abliterated-GGUF-Q4_K_M.gguf Q4_K_M 4.92GB Good quality.
Downloads last month
41
GGUF
Model size
8B params
Architecture
llama
Hardware compatibility
Log In to add your hardware

4-bit

8-bit

Inference Providers NEW
This model isn't deployed by any Inference Provider. ๐Ÿ™‹ Ask for provider support

Model tree for thirteenbit/SicariusSicariiStuff_Wingless_Imp_8B_Abliterated-GGUF