Text Generation
MLX
Safetensors
English
k2_horizon
mlx-lm
4-bit precision
k2-horizon
long-context
512k-context
dense
conversational
custom_code
Instructions to use abenzerps/K2-Horizon-3.7B-MLX-4bit with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- MLX
How to use abenzerps/K2-Horizon-3.7B-MLX-4bit with MLX:
# Make sure mlx-lm is installed # pip install --upgrade mlx-lm # Generate text with mlx-lm from mlx_lm import load, generate model, tokenizer = load("abenzerps/K2-Horizon-3.7B-MLX-4bit") prompt = "Write a story about Einstein" messages = [{"role": "user", "content": prompt}] prompt = tokenizer.apply_chat_template( messages, add_generation_prompt=True ) text = generate(model, tokenizer, prompt=prompt, verbose=True) - Notebooks
- Google Colab
- Kaggle
- Local Apps Settings
- LM Studio
- Pi
How to use abenzerps/K2-Horizon-3.7B-MLX-4bit with Pi:
Start the MLX server
# Install MLX LM: uv tool install mlx-lm # Start a local OpenAI-compatible server: mlx_lm.server --model "abenzerps/K2-Horizon-3.7B-MLX-4bit"
Configure the model in Pi
# Install Pi: npm install -g @earendil-works/pi-coding-agent # Add to ~/.pi/agent/models.json: { "providers": { "mlx-lm": { "baseUrl": "http://localhost:8080/v1", "api": "openai-completions", "apiKey": "none", "models": [ { "id": "abenzerps/K2-Horizon-3.7B-MLX-4bit" } ] } } }Run Pi
# Start Pi in your project directory: pi
- MLX LM
How to use abenzerps/K2-Horizon-3.7B-MLX-4bit with MLX LM:
Generate or start a chat session
# Install MLX LM uv tool install mlx-lm # Interactive chat REPL mlx_lm.chat --model "abenzerps/K2-Horizon-3.7B-MLX-4bit"
Run an OpenAI-compatible server
# Install MLX LM uv tool install mlx-lm # Start the server mlx_lm.server --model "abenzerps/K2-Horizon-3.7B-MLX-4bit" # Calling the OpenAI-compatible server with curl curl -X POST "http://localhost:8000/v1/chat/completions" \ -H "Content-Type: application/json" \ --data '{ "model": "abenzerps/K2-Horizon-3.7B-MLX-4bit", "messages": [ {"role": "user", "content": "Hello"} ] }' - Hermes Agent
How to use abenzerps/K2-Horizon-3.7B-MLX-4bit with Hermes Agent:
Start the MLX server
# Install MLX LM: uv tool install mlx-lm # Start a local OpenAI-compatible server: mlx_lm.server --model "abenzerps/K2-Horizon-3.7B-MLX-4bit"
Configure Hermes
# Install Hermes: curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash hermes setup # Point Hermes at the local server: hermes config set model.provider custom hermes config set model.base_url http://127.0.0.1:8080/v1 hermes config set model.default abenzerps/K2-Horizon-3.7B-MLX-4bit
Run Hermes
hermes
- Atomic Chat
- OpenClaw
How to use abenzerps/K2-Horizon-3.7B-MLX-4bit with OpenClaw:
Start the MLX server
# Install MLX LM: uv tool install mlx-lm # Start a local OpenAI-compatible server: mlx_lm.server --model "abenzerps/K2-Horizon-3.7B-MLX-4bit"
Configure OpenClaw
# Install OpenClaw: npm install -g openclaw@latest # Register the local server and set it as the default model: openclaw onboard --non-interactive --mode local \ --auth-choice custom-api-key \ --custom-base-url http://127.0.0.1:8080/v1 \ --custom-model-id "abenzerps/K2-Horizon-3.7B-MLX-4bit" \ --custom-provider-id mlx-lm \ --custom-compatibility openai \ --custom-text-input \ --accept-risk \ --skip-health
Run OpenClaw
openclaw agent --local --agent main --message "Hello from Hugging Face"
| 0d8e479c380d5d9c8b28ea753205dd9736e53682aaf0038962088cd27c08a0d0 README.md | |
| a892cd0b0195599f283a8c706787520d9a6747640efb2f4dec4144b0abb62590 chat_template.jinja | |
| fec604c00546023bc73b9c00f7aa594831839e9db47ff2f25c288825cbeac1b1 config.json | |
| 5c2f993c1053d9462ebea6dea416c897fddfbb4a5edd904e486936b20d4badc5 configuration_k2_horizon.py | |
| 2da7d47641f4509da4ae47711e31d8b5f0f3f801ee08d87e7e9f07f814bdc4a3 generation_config.json | |
| 56c88b1f4ece81dc946a0b8a2431822aaa67f0ff45c04496d683697c0cb5fef9 k2_horizon_mlx.py | |
| f2155c94d950cbc6d55929b0e46b114a912e211d006ae89bc7ed987b4b1cd2e8 model.safetensors | |
| 0328a4fa1d70bdea50b7e747286e52ada17c145a142fa2cdfe5c944abe91c521 model.safetensors.index.json | |
| fb09e010956bd51cfa7d4055b4381cff34c9e06164066b49e3546f38b2e6242f modeling_k2_horizon.py | |
| 838d767b7c9925ff257feb20eaa4299a8e3cc35bb3d805589c373f51d2cc3cb6 tokenizer.json | |
| 068cfdcf2bcef44fd77f935a9fb41b4d45af547fd41b95079817bd40b24fe518 tokenizer_config.json | |