qwen3-4b-2507-agentic-questionnaire-V2 — GGUF

GGUFs gerados a partir do modelo wilsonramos/qwen3-4b-2507-agentic-questionnaire-V2-merged-hf.

Arquivos

Arquivo Tamanho aproximado
qwen3-4b-2507-agentic-questionnaire-V2-F16.gguf 7.50 GB
qwen3-4b-2507-agentic-questionnaire-V2-Q4_K_M.gguf 2.33 GB
qwen3-4b-2507-agentic-questionnaire-V2-Q5_K_M.gguf 2.69 GB
qwen3-4b-2507-agentic-questionnaire-V2-Q8_0.gguf 3.99 GB

Quantizações

  • F16: maior, referência para conversão.
  • Q8_0: mais pesado, melhor preservação entre os quantizados.
  • Q5_K_M: equilíbrio entre qualidade e tamanho.
  • Q4_K_M: menor e mais prático para uso local.

Tools treinadas

  • get_info_vaga
  • salvar_formulario
  • registrar_falha_formulario

Observação: a qualidade final das chamadas de ferramenta depende de usar, na inferência, o mesmo contrato/schema de tools utilizado no dataset.

Downloads last month
45
GGUF
Model size
4B params
Architecture
qwen3
Hardware compatibility
Log In to add your hardware

4-bit

5-bit

8-bit

16-bit

Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Model tree for wilsonramos/qwen3-4b-2507-agentic-questionnaire-V2-gguf

Quantized
(323)
this model