How to use from
Hermes Agent
Start the llama.cpp server
# Install llama.cpp:
brew install llama.cpp
# Start a local OpenAI-compatible server:
llama serve -hf mamii76/Snowball-7B-Hybrid:Q4_K_M
Configure Hermes
# Install Hermes:
curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash
hermes setup
# Point Hermes at the local server:
hermes config set model.provider custom
hermes config set model.base_url http://127.0.0.1:8080/v1
hermes config set model.default mamii76/Snowball-7B-Hybrid:Q4_K_M
Run Hermes
hermes
Quick Links

❄️ Snowball-7B-Hybrid (كرة الثلج)

نموذج هجين يجمع التفكير المنطقي والبرمجة عبر دمج TIES باستخدام mergekit.

⚠️ اللغة الأساسية: الإنجليزية. الأداء الأفضل في التفكير والبرمجة بالإنجليزية. دعم العربية محدود/تجريبي.

🧬 النماذج المدموجة

  • 🧠 التفكير: open-thoughts/OpenThinker2-7B
  • 💻 البرمجة: Qwen/Qwen2.5-Coder-7B-Instruct
  • ⚙️ الأساس: Qwen/Qwen2.5-7B

📦 الملفات (GGUF)

الملف الحجم الاستخدام
Q4_K_M ~4.4GB متوازن (موصى به)
Q8_0 ~7.6GB دقة أعلى

⚙️ إعدادات التوليد الموصى بها

للحصول على أنظف إجابة وتقليل الإسهاب في النهاية:

llama-cli -m Snowball-7B-Hybrid-Q4_K_M.gguf -cnv \
  --temp 0.6 --top-p 0.9 --top-k 40 --repeat-penalty 1.1 -n 512

🚀 التشغيل (llama.cpp)

llama-cli -m Snowball-7B-Hybrid-Q4_K_M.gguf -p "Write a Python function for prime numbers" -cnv

🛠️ وصفة الدمج

merge_method: ties
base_model: Qwen/Qwen2.5-7B
dtype: bfloat16
tokenizer_source: Qwen/Qwen2.5-Coder-7B-Instruct

صُنع بـ ❤️ — Snowball ❄️


❄️ Snowball-7B-Hybrid

A hybrid model combining logical reasoning and coding via a TIES merge with mergekit.

⚠️ Primary language: English. Best performance for reasoning and coding in English. Arabic support is limited/experimental.

🧬 Merged Models

  • 🧠 Reasoning: open-thoughts/OpenThinker2-7B
  • 💻 Coding: Qwen/Qwen2.5-Coder-7B-Instruct
  • ⚙️ Base: Qwen/Qwen2.5-7B

📦 Files (GGUF)

File Size Use case
Q4_K_M ~4.4GB Balanced (recommended)
Q8_0 ~7.6GB Higher precision

⚙️ Recommended Generation Settings

For the cleanest output and to reduce trailing verbosity:

llama-cli -m Snowball-7B-Hybrid-Q4_K_M.gguf -cnv \
  --temp 0.6 --top-p 0.9 --top-k 40 --repeat-penalty 1.1 -n 512

🚀 Usage (llama.cpp)

llama-cli -m Snowball-7B-Hybrid-Q4_K_M.gguf -p "Write a Python function for prime numbers" -cnv

🛠️ Merge Recipe

merge_method: ties
base_model: Qwen/Qwen2.5-7B
dtype: bfloat16
tokenizer_source: Qwen/Qwen2.5-Coder-7B-Instruct

Made with ❤️ — Snowball ❄️

Downloads last month
18
GGUF
Model size
8B params
Architecture
qwen2
Hardware compatibility
Log In to add your hardware

4-bit

8-bit

Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Model tree for mamii76/Snowball-7B-Hybrid