Image-Text-to-Text
MLX
Safetensors
English
qwen4_exp
jang
jang-4m
quantized
apple-silicon
vision
video
reasoning
agent
tool-use
Mixture of Experts
ngram-embedding
imatrix
awq
conversational
Instructions to use JANGQ-AI/Qwen3.8-Flash-Next-JANG_4M with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- MLX
How to use JANGQ-AI/Qwen3.8-Flash-Next-JANG_4M with MLX:
# Make sure mlx-vlm is installed # pip install --upgrade mlx-vlm from mlx_vlm import load, generate from mlx_vlm.prompt_utils import apply_chat_template from mlx_vlm.utils import load_config # Load the model model, processor = load("JANGQ-AI/Qwen3.8-Flash-Next-JANG_4M") config = load_config("JANGQ-AI/Qwen3.8-Flash-Next-JANG_4M") # Prepare input image = ["http://images.cocodataset.org/val2017/000000039769.jpg"] prompt = "Describe this image." # Apply chat template formatted_prompt = apply_chat_template( processor, config, prompt, num_images=1 ) # Generate output output = generate(model, processor, formatted_prompt, image) print(output) - Notebooks
- Google Colab
- Kaggle
- Local Apps Settings
- LM Studio
- Pi
How to use JANGQ-AI/Qwen3.8-Flash-Next-JANG_4M with Pi:
Start the MLX server
# Install MLX LM: uv tool install mlx-lm # Start a local OpenAI-compatible server: mlx_lm.server --model "JANGQ-AI/Qwen3.8-Flash-Next-JANG_4M"
Configure the model in Pi
# Install Pi: npm install -g @earendil-works/pi-coding-agent # Add to ~/.pi/agent/models.json: { "providers": { "mlx-lm": { "baseUrl": "http://localhost:8080/v1", "api": "openai-completions", "apiKey": "none", "models": [ { "id": "JANGQ-AI/Qwen3.8-Flash-Next-JANG_4M" } ] } } }Run Pi
# Start Pi in your project directory: pi
- Hermes Agent
How to use JANGQ-AI/Qwen3.8-Flash-Next-JANG_4M with Hermes Agent:
Start the MLX server
# Install MLX LM: uv tool install mlx-lm # Start a local OpenAI-compatible server: mlx_lm.server --model "JANGQ-AI/Qwen3.8-Flash-Next-JANG_4M"
Configure Hermes
# Install Hermes: curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash hermes setup # Point Hermes at the local server: hermes config set model.provider custom hermes config set model.base_url http://127.0.0.1:8080/v1 hermes config set model.default JANGQ-AI/Qwen3.8-Flash-Next-JANG_4M
Run Hermes
hermes
- Atomic Chat
- OpenClaw
How to use JANGQ-AI/Qwen3.8-Flash-Next-JANG_4M with OpenClaw:
Start the MLX server
# Install MLX LM: uv tool install mlx-lm # Start a local OpenAI-compatible server: mlx_lm.server --model "JANGQ-AI/Qwen3.8-Flash-Next-JANG_4M"
Configure OpenClaw
# Install OpenClaw: npm install -g openclaw@latest # Register the local server and set it as the default model: openclaw onboard --non-interactive --mode local \ --auth-choice custom-api-key \ --custom-base-url http://127.0.0.1:8080/v1 \ --custom-model-id "JANGQ-AI/Qwen3.8-Flash-Next-JANG_4M" \ --custom-provider-id mlx-lm \ --custom-compatibility openai \ --custom-text-input \ --accept-risk \ --skip-health
Run OpenClaw
openclaw agent --local --agent main --message "Hello from Hugging Face"
rebuild
Browse files- .DS_Store +0 -0
- README.md +24 -12
- config.json +0 -0
- jang_ladder_wide.png +2 -2
- jangq-logo.png +0 -0
- model-00001-of-00026.safetensors +2 -2
- model-00002-of-00026.safetensors +2 -2
- model-00003-of-00026.safetensors +2 -2
- model-00004-of-00026.safetensors +2 -2
- model-00005-of-00026.safetensors +2 -2
- model-00006-of-00026.safetensors +2 -2
- model-00007-of-00026.safetensors +2 -2
- model-00008-of-00026.safetensors +2 -2
- model-00009-of-00026.safetensors +2 -2
- model-00010-of-00026.safetensors +2 -2
- model-00011-of-00026.safetensors +2 -2
- model-00012-of-00026.safetensors +2 -2
- model-00013-of-00026.safetensors +2 -2
- model-00014-of-00026.safetensors +2 -2
- model-00015-of-00026.safetensors +2 -2
- model-00016-of-00026.safetensors +2 -2
- model-00017-of-00026.safetensors +2 -2
- model-00018-of-00026.safetensors +2 -2
- model-00019-of-00026.safetensors +2 -2
- model-00020-of-00026.safetensors +2 -2
- model-00021-of-00026.safetensors +2 -2
- model-00022-of-00026.safetensors +2 -2
- model-00023-of-00026.safetensors +2 -2
- model.safetensors.index.json +14 -14
- vmlx-logo.png +0 -0
.DS_Store
ADDED
|
Binary file (8.2 kB). View file
|
|
|
README.md
CHANGED
|
@@ -25,9 +25,15 @@ tags:
|
|
| 25 |
- awq
|
| 26 |
---
|
| 27 |
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 28 |
# JANGQ-AI/Qwen3.8-Flash-Next-JANG_4M
|
| 29 |
|
| 30 |
-
**The recommended quality/size balance — median KL 0.
|
| 31 |
|
| 32 |
A JANG bundle of [Qwen/Qwen3.8-Flash-Next](https://huggingface.co/Qwen/Qwen3.8-Flash-Next)
|
| 33 |
— the Qwen4-architecture preview: a 125B mixture-of-experts (512 experts,
|
|
@@ -36,8 +42,10 @@ Attention hybrid layers, gated-residual streams, and vision+video towers —
|
|
| 36 |
quantized for Apple Silicon / MLX. Text, image and video weights are all
|
| 37 |
present in this exact bundle. Native multi-token-prediction head preserved (4-bit).
|
| 38 |
|
| 39 |
-
>
|
| 40 |
-
> is
|
|
|
|
|
|
|
| 41 |
|
| 42 |
## Quality (measured, 5,931 held-out positions vs bf16)
|
| 43 |
|
|
@@ -45,21 +53,25 @@ present in this exact bundle. Native multi-token-prediction head preserved (4-bi
|
|
| 45 |
|
| 46 |
| Tier | Size | RAM w/ SSD-table | median KL | top-1 | top-5 | top-10 |
|
| 47 |
|---|---|---|---|---|---|---|
|
| 48 |
-
| JANG_1L |
|
| 49 |
-
| JANG_2L | 65.
|
| 50 |
-
| JANG_4S |
|
| 51 |
-
| **JANG_4M** | **96.
|
| 52 |
-
| JANG_6S | 106.
|
| 53 |
|
| 54 |
Margin-conditioned flip curves are monotone-decreasing on every tier —
|
| 55 |
quantization noise lives in the reference model's own uncertainty band, with
|
| 56 |
zero disagreement at high-confidence positions on the upper tiers.
|
| 57 |
|
| 58 |
-
## The n-gram table & memory
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 59 |
|
| 60 |
-
The 51B n-gram embedding can be served directly from SSD by supporting
|
| 61 |
-
runtimes; the "RAM w/ SSD-table" column above is the resident footprint in
|
| 62 |
-
that mode.
|
| 63 |
|
| 64 |
## What's in the bundle
|
| 65 |
|
|
|
|
| 25 |
- awq
|
| 26 |
---
|
| 27 |
|
| 28 |
+
<p align="center">
|
| 29 |
+
<img src="./jangq-logo.png" alt="JANGQ" width="220">
|
| 30 |
+
|
| 31 |
+
<img src="./vmlx-logo.png" alt="vMLX" width="90">
|
| 32 |
+
</p>
|
| 33 |
+
|
| 34 |
# JANGQ-AI/Qwen3.8-Flash-Next-JANG_4M
|
| 35 |
|
| 36 |
+
**The recommended quality/size balance — median KL 0.0042 vs bf16 at 96.0 GiB (~73 GiB resident with the SSD-served table).**
|
| 37 |
|
| 38 |
A JANG bundle of [Qwen/Qwen3.8-Flash-Next](https://huggingface.co/Qwen/Qwen3.8-Flash-Next)
|
| 39 |
— the Qwen4-architecture preview: a 125B mixture-of-experts (512 experts,
|
|
|
|
| 42 |
quantized for Apple Silicon / MLX. Text, image and video weights are all
|
| 43 |
present in this exact bundle. Native multi-token-prediction head preserved (4-bit).
|
| 44 |
|
| 45 |
+
> **Best experienced in vMLX.** This bundle's layout — the SSD-served n-gram
|
| 46 |
+
> table, per-module mixed precision, and the native MTP head — is designed for
|
| 47 |
+
> the vMLX serving path. Access is gated (manual approval) while runtime
|
| 48 |
+
> support rolls out.
|
| 49 |
|
| 50 |
## Quality (measured, 5,931 held-out positions vs bf16)
|
| 51 |
|
|
|
|
| 53 |
|
| 54 |
| Tier | Size | RAM w/ SSD-table | median KL | top-1 | top-5 | top-10 |
|
| 55 |
|---|---|---|---|---|---|---|
|
| 56 |
+
| JANG_1L | 59.8 GiB | ~41 GiB | 0.0362 | 86.7% | 97.5% | 98.8% |
|
| 57 |
+
| JANG_2L | 65.3 GiB | ~48 GiB | 0.0260 | 88.2% | 98.2% | 99.0% |
|
| 58 |
+
| JANG_4S | 71.8 GiB | ~53 GiB | 0.0161 | 89.4% | 98.7% | 99.4% |
|
| 59 |
+
| **JANG_4M** | **96.0 GiB** | **~73 GiB** | **0.0042** | **94.4%** | **99.7%** | **99.9%** |
|
| 60 |
+
| JANG_6S | 106.3 GiB | ~83 GiB | 0.0035 | 94.7% | 99.7% | 99.9% |
|
| 61 |
|
| 62 |
Margin-conditioned flip curves are monotone-decreasing on every tier —
|
| 63 |
quantization noise lives in the reference model's own uncertainty band, with
|
| 64 |
zero disagreement at high-confidence positions on the upper tiers.
|
| 65 |
|
| 66 |
+
## The n-gram table & memory — SSD caching, fixed and fast
|
| 67 |
+
|
| 68 |
+
The 51B n-gram embedding streams **directly from SSD** on supporting runtimes
|
| 69 |
+
(16 row-reads per token) — the "RAM w/ SSD-table" column above is the true
|
| 70 |
+
resident footprint in that mode. Early runtime builds throttled in this mode;
|
| 71 |
+
**SSD-table caching is now fixed**: decode runs at full speed with the table
|
| 72 |
+
on disk — 40+ tok/s on an M5 Max for the 4-bit tier — so the biggest tiers fit
|
| 73 |
+
comfortably on 64–128 GB machines without giving up the table.
|
| 74 |
|
|
|
|
|
|
|
|
|
|
| 75 |
|
| 76 |
## What's in the bundle
|
| 77 |
|
config.json
CHANGED
|
The diff for this file is too large to render.
See raw diff
|
|
|
jang_ladder_wide.png
CHANGED
|
Git LFS Details
|
|
Git LFS Details
|
jangq-logo.png
ADDED
|
model-00001-of-00026.safetensors
CHANGED
|
@@ -1,3 +1,3 @@
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
-
oid sha256:
|
| 3 |
-
size
|
|
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:0bd29b8a0865ff222f1e959ba46b1803c193abf53325aa1880a06c50f2ee2b58
|
| 3 |
+
size 5486992131
|
model-00002-of-00026.safetensors
CHANGED
|
@@ -1,3 +1,3 @@
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
-
oid sha256:
|
| 3 |
-
size
|
|
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:5f2afd711ba2c1ca0bcc750033bdeed073524cd391923f52bc164ee3e67cbbc7
|
| 3 |
+
size 5550037500
|
model-00003-of-00026.safetensors
CHANGED
|
@@ -1,3 +1,3 @@
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
-
oid sha256:
|
| 3 |
-
size
|
|
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:001e46e174f9c59ff7ed70a19572b6a072456fcea3b5103bef656380774cf046
|
| 3 |
+
size 5450036517
|
model-00004-of-00026.safetensors
CHANGED
|
@@ -1,3 +1,3 @@
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
-
oid sha256:
|
| 3 |
-
size
|
|
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:7a0a002f1c247841372cf8969171e9935eae06bfcb7a628ac33f97840557f6e1
|
| 3 |
+
size 5550037008
|
model-00005-of-00026.safetensors
CHANGED
|
@@ -1,3 +1,3 @@
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
-
oid sha256:
|
| 3 |
-
size
|
|
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:1a1330b33bfb915fa070704cb3b9aaf19b9a910337f00813ac1cb61149f2b199
|
| 3 |
+
size 5400036692
|
model-00006-of-00026.safetensors
CHANGED
|
@@ -1,3 +1,3 @@
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
-
oid sha256:
|
| 3 |
-
size
|
|
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:1a16e3534565e3e629cd1e8ca6ff4299fd5e896298c9e9c40bb668cbff09c01a
|
| 3 |
+
size 3520604420
|
model-00007-of-00026.safetensors
CHANGED
|
@@ -1,3 +1,3 @@
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
-
oid sha256:
|
| 3 |
-
size
|
|
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:30418f088234d40133eceae84be586ff1210ecde7f68d2fc8f75a589a9d383c9
|
| 3 |
+
size 5482961881
|
model-00008-of-00026.safetensors
CHANGED
|
@@ -1,3 +1,3 @@
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
-
oid sha256:
|
| 3 |
-
size
|
|
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:4fd30a4f043287ad7a90629b6d3be8bf08ef10ebe9144c69acc7a7ab261c6ba1
|
| 3 |
+
size 5562155614
|
model-00009-of-00026.safetensors
CHANGED
|
@@ -1,3 +1,3 @@
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
-
oid sha256:
|
| 3 |
-
size
|
|
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:b430f767e7d97c1e6a6d1f52076c132f097431b2a9d0127b7c29bad9f0c0b7c1
|
| 3 |
+
size 1022912939
|
model-00010-of-00026.safetensors
CHANGED
|
@@ -1,3 +1,3 @@
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
-
oid sha256:
|
| 3 |
-
size
|
|
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:cc3f947fe1dd516d472418770e1ec01837c6dc571bf3ae3d1817b90d7a50bf9b
|
| 3 |
+
size 5482961900
|
model-00011-of-00026.safetensors
CHANGED
|
@@ -1,3 +1,3 @@
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
-
oid sha256:
|
| 3 |
-
size
|
|
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:44832edabc381e7b9296bd4237b72207d9ba469a4432b3ea19c045373e672011
|
| 3 |
+
size 5562155720
|
model-00012-of-00026.safetensors
CHANGED
|
@@ -1,3 +1,3 @@
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
-
oid sha256:
|
| 3 |
-
size
|
|
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:e55aed126efb552db83aee7be5d39f2a16086b5343c5bd2892f9069cdb270e03
|
| 3 |
+
size 1022912927
|
model-00013-of-00026.safetensors
CHANGED
|
@@ -1,3 +1,3 @@
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
-
oid sha256:
|
| 3 |
-
size
|
|
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:3a91247f159acd2cf3a127af38f057fdded10bf2921debe7bb803e9ee928bc1c
|
| 3 |
+
size 5482961939
|
model-00014-of-00026.safetensors
CHANGED
|
@@ -1,3 +1,3 @@
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
-
oid sha256:
|
| 3 |
-
size
|
|
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:623d8ac461c05795633e396d60ba6de5b54df83d8f05be0efc72a8bfc6a92a15
|
| 3 |
+
size 5500533628
|
model-00015-of-00026.safetensors
CHANGED
|
@@ -1,3 +1,3 @@
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
-
oid sha256:
|
| 3 |
-
size
|
|
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:60d60b04e812d782e037f0147961ee30e1b252ced989180d90122ec25b5b674a
|
| 3 |
+
size 1077577930
|
model-00016-of-00026.safetensors
CHANGED
|
@@ -1,3 +1,3 @@
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
-
oid sha256:
|
| 3 |
-
size
|
|
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:7022950db97be03eb74c357444de0c623567beb4f764b1275abec3c788642a34
|
| 3 |
+
size 5428296850
|
model-00017-of-00026.safetensors
CHANGED
|
@@ -1,3 +1,3 @@
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
-
oid sha256:
|
| 3 |
-
size
|
|
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:360234a7b82bde72b4e4558fef75762e52cf909d9c3a535a8bae44c8f711d505
|
| 3 |
+
size 5562155736
|
model-00018-of-00026.safetensors
CHANGED
|
@@ -1,3 +1,3 @@
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
-
oid sha256:
|
| 3 |
-
size
|
|
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:e9523f5f909402201b67d69caa6fc4ad37c8df6d51151804f0b15f041a3539a6
|
| 3 |
+
size 1077577927
|
model-00019-of-00026.safetensors
CHANGED
|
@@ -1,3 +1,3 @@
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
-
oid sha256:
|
| 3 |
-
size
|
|
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:05b6362076bac322444166387ba4d915f3a63c114e72ed8b76488c41804e7df6
|
| 3 |
+
size 5489918919
|
model-00020-of-00026.safetensors
CHANGED
|
@@ -1,3 +1,3 @@
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
-
oid sha256:
|
| 3 |
-
size
|
|
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:d48d4da6a9bd2aa7221d454a68d410b4b54b7f9b878179f732cbfd5be1aacb2a
|
| 3 |
+
size 5562155602
|
model-00021-of-00026.safetensors
CHANGED
|
@@ -1,3 +1,3 @@
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
-
oid sha256:
|
| 3 |
-
size
|
|
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:67584e42b7a0fe09a9b807fbccbc4842b9396c9a82a4a62fe64f9f6fda02ccce
|
| 3 |
+
size 1029190432
|
model-00022-of-00026.safetensors
CHANGED
|
@@ -1,3 +1,3 @@
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
-
oid sha256:
|
| 3 |
-
size
|
|
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:15e2c87f79d546bfe89b77d002492f585d1d619920a4bf02bd0b1c46b31fea6e
|
| 3 |
+
size 5415062308
|
model-00023-of-00026.safetensors
CHANGED
|
@@ -1,3 +1,3 @@
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
-
oid sha256:
|
| 3 |
-
size
|
|
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:8d5a96e5b61309ada3e2fd556e704180e8484dd74e5ce5ed9d28abccf1ecdf5c
|
| 3 |
+
size 5632512775
|
model.safetensors.index.json
CHANGED
|
@@ -1,6 +1,6 @@
|
|
| 1 |
{
|
| 2 |
"metadata": {
|
| 3 |
-
"total_size":
|
| 4 |
},
|
| 5 |
"weight_map": {
|
| 6 |
"language_model.embed_tokens.weight": "model-00001-of-00026.safetensors",
|
|
@@ -136,7 +136,7 @@
|
|
| 136 |
"language_model.layers.1.ple.ngram_embedding.shards.104.weight": "model-00001-of-00026.safetensors",
|
| 137 |
"language_model.layers.1.ple.ngram_embedding.shards.104.scales": "model-00001-of-00026.safetensors",
|
| 138 |
"language_model.layers.1.ple.ngram_embedding.shards.104.biases": "model-00001-of-00026.safetensors",
|
| 139 |
-
"language_model.layers.1.ple.ngram_embedding.shards.105.weight": "model-
|
| 140 |
"language_model.layers.1.ple.ngram_embedding.shards.105.scales": "model-00002-of-00026.safetensors",
|
| 141 |
"language_model.layers.1.ple.ngram_embedding.shards.105.biases": "model-00002-of-00026.safetensors",
|
| 142 |
"language_model.layers.1.ple.ngram_embedding.shards.106.weight": "model-00002-of-00026.safetensors",
|
|
@@ -212,9 +212,9 @@
|
|
| 212 |
"language_model.layers.1.ple.ngram_embedding.shards.127.scales": "model-00002-of-00026.safetensors",
|
| 213 |
"language_model.layers.1.ple.ngram_embedding.shards.127.biases": "model-00002-of-00026.safetensors",
|
| 214 |
"language_model.layers.1.ple.ngram_embedding.shards.13.weight": "model-00002-of-00026.safetensors",
|
| 215 |
-
"language_model.layers.1.ple.ngram_embedding.shards.13.scales": "model-
|
| 216 |
-
"language_model.layers.1.ple.ngram_embedding.shards.13.biases": "model-
|
| 217 |
-
"language_model.layers.1.ple.ngram_embedding.shards.14.weight": "model-
|
| 218 |
"language_model.layers.1.ple.ngram_embedding.shards.14.scales": "model-00003-of-00026.safetensors",
|
| 219 |
"language_model.layers.1.ple.ngram_embedding.shards.14.biases": "model-00003-of-00026.safetensors",
|
| 220 |
"language_model.layers.1.ple.ngram_embedding.shards.15.weight": "model-00003-of-00026.safetensors",
|
|
@@ -287,9 +287,9 @@
|
|
| 287 |
"language_model.layers.1.ple.ngram_embedding.shards.35.scales": "model-00003-of-00026.safetensors",
|
| 288 |
"language_model.layers.1.ple.ngram_embedding.shards.35.biases": "model-00003-of-00026.safetensors",
|
| 289 |
"language_model.layers.1.ple.ngram_embedding.shards.36.weight": "model-00003-of-00026.safetensors",
|
| 290 |
-
"language_model.layers.1.ple.ngram_embedding.shards.36.scales": "model-
|
| 291 |
-
"language_model.layers.1.ple.ngram_embedding.shards.36.biases": "model-
|
| 292 |
-
"language_model.layers.1.ple.ngram_embedding.shards.37.weight": "model-
|
| 293 |
"language_model.layers.1.ple.ngram_embedding.shards.37.scales": "model-00004-of-00026.safetensors",
|
| 294 |
"language_model.layers.1.ple.ngram_embedding.shards.37.biases": "model-00004-of-00026.safetensors",
|
| 295 |
"language_model.layers.1.ple.ngram_embedding.shards.38.weight": "model-00004-of-00026.safetensors",
|
|
@@ -362,9 +362,9 @@
|
|
| 362 |
"language_model.layers.1.ple.ngram_embedding.shards.58.scales": "model-00004-of-00026.safetensors",
|
| 363 |
"language_model.layers.1.ple.ngram_embedding.shards.58.biases": "model-00004-of-00026.safetensors",
|
| 364 |
"language_model.layers.1.ple.ngram_embedding.shards.59.weight": "model-00004-of-00026.safetensors",
|
| 365 |
-
"language_model.layers.1.ple.ngram_embedding.shards.59.scales": "model-
|
| 366 |
-
"language_model.layers.1.ple.ngram_embedding.shards.59.biases": "model-
|
| 367 |
-
"language_model.layers.1.ple.ngram_embedding.shards.6.weight": "model-
|
| 368 |
"language_model.layers.1.ple.ngram_embedding.shards.6.scales": "model-00005-of-00026.safetensors",
|
| 369 |
"language_model.layers.1.ple.ngram_embedding.shards.6.biases": "model-00005-of-00026.safetensors",
|
| 370 |
"language_model.layers.1.ple.ngram_embedding.shards.60.weight": "model-00005-of-00026.safetensors",
|
|
@@ -440,9 +440,9 @@
|
|
| 440 |
"language_model.layers.1.ple.ngram_embedding.shards.81.scales": "model-00005-of-00026.safetensors",
|
| 441 |
"language_model.layers.1.ple.ngram_embedding.shards.81.biases": "model-00005-of-00026.safetensors",
|
| 442 |
"language_model.layers.1.ple.ngram_embedding.shards.82.weight": "model-00005-of-00026.safetensors",
|
| 443 |
-
"language_model.layers.1.ple.ngram_embedding.shards.82.scales": "model-
|
| 444 |
-
"language_model.layers.1.ple.ngram_embedding.shards.82.biases": "model-
|
| 445 |
-
"language_model.layers.1.ple.ngram_embedding.shards.83.weight": "model-
|
| 446 |
"language_model.layers.1.ple.ngram_embedding.shards.83.scales": "model-00006-of-00026.safetensors",
|
| 447 |
"language_model.layers.1.ple.ngram_embedding.shards.83.biases": "model-00006-of-00026.safetensors",
|
| 448 |
"language_model.layers.1.ple.ngram_embedding.shards.84.weight": "model-00006-of-00026.safetensors",
|
|
|
|
| 1 |
{
|
| 2 |
"metadata": {
|
| 3 |
+
"total_size": 103108944248
|
| 4 |
},
|
| 5 |
"weight_map": {
|
| 6 |
"language_model.embed_tokens.weight": "model-00001-of-00026.safetensors",
|
|
|
|
| 136 |
"language_model.layers.1.ple.ngram_embedding.shards.104.weight": "model-00001-of-00026.safetensors",
|
| 137 |
"language_model.layers.1.ple.ngram_embedding.shards.104.scales": "model-00001-of-00026.safetensors",
|
| 138 |
"language_model.layers.1.ple.ngram_embedding.shards.104.biases": "model-00001-of-00026.safetensors",
|
| 139 |
+
"language_model.layers.1.ple.ngram_embedding.shards.105.weight": "model-00001-of-00026.safetensors",
|
| 140 |
"language_model.layers.1.ple.ngram_embedding.shards.105.scales": "model-00002-of-00026.safetensors",
|
| 141 |
"language_model.layers.1.ple.ngram_embedding.shards.105.biases": "model-00002-of-00026.safetensors",
|
| 142 |
"language_model.layers.1.ple.ngram_embedding.shards.106.weight": "model-00002-of-00026.safetensors",
|
|
|
|
| 212 |
"language_model.layers.1.ple.ngram_embedding.shards.127.scales": "model-00002-of-00026.safetensors",
|
| 213 |
"language_model.layers.1.ple.ngram_embedding.shards.127.biases": "model-00002-of-00026.safetensors",
|
| 214 |
"language_model.layers.1.ple.ngram_embedding.shards.13.weight": "model-00002-of-00026.safetensors",
|
| 215 |
+
"language_model.layers.1.ple.ngram_embedding.shards.13.scales": "model-00002-of-00026.safetensors",
|
| 216 |
+
"language_model.layers.1.ple.ngram_embedding.shards.13.biases": "model-00002-of-00026.safetensors",
|
| 217 |
+
"language_model.layers.1.ple.ngram_embedding.shards.14.weight": "model-00002-of-00026.safetensors",
|
| 218 |
"language_model.layers.1.ple.ngram_embedding.shards.14.scales": "model-00003-of-00026.safetensors",
|
| 219 |
"language_model.layers.1.ple.ngram_embedding.shards.14.biases": "model-00003-of-00026.safetensors",
|
| 220 |
"language_model.layers.1.ple.ngram_embedding.shards.15.weight": "model-00003-of-00026.safetensors",
|
|
|
|
| 287 |
"language_model.layers.1.ple.ngram_embedding.shards.35.scales": "model-00003-of-00026.safetensors",
|
| 288 |
"language_model.layers.1.ple.ngram_embedding.shards.35.biases": "model-00003-of-00026.safetensors",
|
| 289 |
"language_model.layers.1.ple.ngram_embedding.shards.36.weight": "model-00003-of-00026.safetensors",
|
| 290 |
+
"language_model.layers.1.ple.ngram_embedding.shards.36.scales": "model-00003-of-00026.safetensors",
|
| 291 |
+
"language_model.layers.1.ple.ngram_embedding.shards.36.biases": "model-00003-of-00026.safetensors",
|
| 292 |
+
"language_model.layers.1.ple.ngram_embedding.shards.37.weight": "model-00003-of-00026.safetensors",
|
| 293 |
"language_model.layers.1.ple.ngram_embedding.shards.37.scales": "model-00004-of-00026.safetensors",
|
| 294 |
"language_model.layers.1.ple.ngram_embedding.shards.37.biases": "model-00004-of-00026.safetensors",
|
| 295 |
"language_model.layers.1.ple.ngram_embedding.shards.38.weight": "model-00004-of-00026.safetensors",
|
|
|
|
| 362 |
"language_model.layers.1.ple.ngram_embedding.shards.58.scales": "model-00004-of-00026.safetensors",
|
| 363 |
"language_model.layers.1.ple.ngram_embedding.shards.58.biases": "model-00004-of-00026.safetensors",
|
| 364 |
"language_model.layers.1.ple.ngram_embedding.shards.59.weight": "model-00004-of-00026.safetensors",
|
| 365 |
+
"language_model.layers.1.ple.ngram_embedding.shards.59.scales": "model-00004-of-00026.safetensors",
|
| 366 |
+
"language_model.layers.1.ple.ngram_embedding.shards.59.biases": "model-00004-of-00026.safetensors",
|
| 367 |
+
"language_model.layers.1.ple.ngram_embedding.shards.6.weight": "model-00004-of-00026.safetensors",
|
| 368 |
"language_model.layers.1.ple.ngram_embedding.shards.6.scales": "model-00005-of-00026.safetensors",
|
| 369 |
"language_model.layers.1.ple.ngram_embedding.shards.6.biases": "model-00005-of-00026.safetensors",
|
| 370 |
"language_model.layers.1.ple.ngram_embedding.shards.60.weight": "model-00005-of-00026.safetensors",
|
|
|
|
| 440 |
"language_model.layers.1.ple.ngram_embedding.shards.81.scales": "model-00005-of-00026.safetensors",
|
| 441 |
"language_model.layers.1.ple.ngram_embedding.shards.81.biases": "model-00005-of-00026.safetensors",
|
| 442 |
"language_model.layers.1.ple.ngram_embedding.shards.82.weight": "model-00005-of-00026.safetensors",
|
| 443 |
+
"language_model.layers.1.ple.ngram_embedding.shards.82.scales": "model-00005-of-00026.safetensors",
|
| 444 |
+
"language_model.layers.1.ple.ngram_embedding.shards.82.biases": "model-00005-of-00026.safetensors",
|
| 445 |
+
"language_model.layers.1.ple.ngram_embedding.shards.83.weight": "model-00005-of-00026.safetensors",
|
| 446 |
"language_model.layers.1.ple.ngram_embedding.shards.83.scales": "model-00006-of-00026.safetensors",
|
| 447 |
"language_model.layers.1.ple.ngram_embedding.shards.83.biases": "model-00006-of-00026.safetensors",
|
| 448 |
"language_model.layers.1.ple.ngram_embedding.shards.84.weight": "model-00006-of-00026.safetensors",
|
vmlx-logo.png
ADDED
|