shengliangx commited on
Commit
9377ce9
·
0 Parent(s):

GLM-5.3-Flash-NVFP4 (NVFP4 routed experts + dense MLP, FP8 KV cache)

Browse files
Files changed (43) hide show
  1. .gitattributes +37 -0
  2. .quant_summary.txt +0 -0
  3. chat_template.jinja +257 -0
  4. config.json +469 -0
  5. generation_config.json +13 -0
  6. hf_quant_config.json +145 -0
  7. model-00001-of-00033.safetensors +3 -0
  8. model-00002-of-00033.safetensors +3 -0
  9. model-00003-of-00033.safetensors +3 -0
  10. model-00004-of-00033.safetensors +3 -0
  11. model-00005-of-00033.safetensors +3 -0
  12. model-00006-of-00033.safetensors +3 -0
  13. model-00007-of-00033.safetensors +3 -0
  14. model-00008-of-00033.safetensors +3 -0
  15. model-00009-of-00033.safetensors +3 -0
  16. model-00010-of-00033.safetensors +3 -0
  17. model-00011-of-00033.safetensors +3 -0
  18. model-00012-of-00033.safetensors +3 -0
  19. model-00013-of-00033.safetensors +3 -0
  20. model-00014-of-00033.safetensors +3 -0
  21. model-00015-of-00033.safetensors +3 -0
  22. model-00016-of-00033.safetensors +3 -0
  23. model-00017-of-00033.safetensors +3 -0
  24. model-00018-of-00033.safetensors +3 -0
  25. model-00019-of-00033.safetensors +3 -0
  26. model-00020-of-00033.safetensors +3 -0
  27. model-00021-of-00033.safetensors +3 -0
  28. model-00022-of-00033.safetensors +3 -0
  29. model-00023-of-00033.safetensors +3 -0
  30. model-00024-of-00033.safetensors +3 -0
  31. model-00025-of-00033.safetensors +3 -0
  32. model-00026-of-00033.safetensors +3 -0
  33. model-00027-of-00033.safetensors +3 -0
  34. model-00028-of-00033.safetensors +3 -0
  35. model-00029-of-00033.safetensors +3 -0
  36. model-00030-of-00033.safetensors +3 -0
  37. model-00031-of-00033.safetensors +3 -0
  38. model-00032-of-00033.safetensors +3 -0
  39. model-00033-of-00033.safetensors +3 -0
  40. model.safetensors.index.json +3 -0
  41. processor_config.json +44 -0
  42. tokenizer.json +3 -0
  43. tokenizer_config.json +33 -0
.gitattributes ADDED
@@ -0,0 +1,37 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ *.7z filter=lfs diff=lfs merge=lfs -text
2
+ *.arrow filter=lfs diff=lfs merge=lfs -text
3
+ *.bin filter=lfs diff=lfs merge=lfs -text
4
+ *.bz2 filter=lfs diff=lfs merge=lfs -text
5
+ *.ckpt filter=lfs diff=lfs merge=lfs -text
6
+ *.ftz filter=lfs diff=lfs merge=lfs -text
7
+ *.gz filter=lfs diff=lfs merge=lfs -text
8
+ *.h5 filter=lfs diff=lfs merge=lfs -text
9
+ *.joblib filter=lfs diff=lfs merge=lfs -text
10
+ *.lfs.* filter=lfs diff=lfs merge=lfs -text
11
+ *.mlmodel filter=lfs diff=lfs merge=lfs -text
12
+ *.model filter=lfs diff=lfs merge=lfs -text
13
+ *.msgpack filter=lfs diff=lfs merge=lfs -text
14
+ *.npy filter=lfs diff=lfs merge=lfs -text
15
+ *.npz filter=lfs diff=lfs merge=lfs -text
16
+ *.onnx filter=lfs diff=lfs merge=lfs -text
17
+ *.ot filter=lfs diff=lfs merge=lfs -text
18
+ *.parquet filter=lfs diff=lfs merge=lfs -text
19
+ *.pb filter=lfs diff=lfs merge=lfs -text
20
+ *.pickle filter=lfs diff=lfs merge=lfs -text
21
+ *.pkl filter=lfs diff=lfs merge=lfs -text
22
+ *.pt filter=lfs diff=lfs merge=lfs -text
23
+ *.pth filter=lfs diff=lfs merge=lfs -text
24
+ *.rar filter=lfs diff=lfs merge=lfs -text
25
+ *.safetensors filter=lfs diff=lfs merge=lfs -text
26
+ saved_model/**/* filter=lfs diff=lfs merge=lfs -text
27
+ *.tar.* filter=lfs diff=lfs merge=lfs -text
28
+ *.tar filter=lfs diff=lfs merge=lfs -text
29
+ *.tflite filter=lfs diff=lfs merge=lfs -text
30
+ *.tgz filter=lfs diff=lfs merge=lfs -text
31
+ *.wasm filter=lfs diff=lfs merge=lfs -text
32
+ *.xz filter=lfs diff=lfs merge=lfs -text
33
+ *.zip filter=lfs diff=lfs merge=lfs -text
34
+ *.zst filter=lfs diff=lfs merge=lfs -text
35
+ *tfevents* filter=lfs diff=lfs merge=lfs -text
36
+ tokenizer.json filter=lfs diff=lfs merge=lfs -text
37
+ model.safetensors.index.json filter=lfs diff=lfs merge=lfs -text
.quant_summary.txt ADDED
The diff for this file is too large to render. See raw diff
 
chat_template.jinja ADDED
@@ -0,0 +1,257 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ [gMASK]<sop>
2
+ {%- set effective_reasoning_effort = reasoning_effort if reasoning_effort is defined and reasoning_effort in ['low', 'high'] else 'max' -%}
3
+ {%- if effective_reasoning_effort is not none -%}<|system|>Reasoning Effort: {{ effective_reasoning_effort | capitalize }}{%- endif -%}
4
+ {%- set clear_thinking = clear_thinking if clear_thinking is defined else false -%}
5
+ {%- if tools -%}
6
+ {%- macro tool_to_json(tool) -%}
7
+ {%- set ns_tool = namespace(first=true) -%}
8
+ {{ '{' -}}
9
+ {%- for k, v in tool.items() -%}
10
+ {%- if k != 'defer_loading' and k != 'strict' -%}
11
+ {%- if not ns_tool.first -%}{{- ', ' -}}{%- endif -%}
12
+ {%- set ns_tool.first = false -%}
13
+ "{{ k }}": {{ v | tojson(ensure_ascii=False) }}
14
+ {%- endif -%}
15
+ {%- endfor -%}
16
+ {{- '}' -}}
17
+ {%- endmacro -%}
18
+ {%- macro tool_references_to_response(refs) -%}
19
+ {{- '<tool_response><tools>\n' -}}
20
+ {%- for tr in refs -%}
21
+ {%- for tool in tools -%}
22
+ {%- if 'function' in tool -%}
23
+ {%- set tool = tool['function'] -%}
24
+ {%- endif -%}
25
+ {%- if tool.name == tr.name -%}
26
+ {{- tool_to_json(tool) + '\n' -}}
27
+ {%- endif -%}
28
+ {%- endfor -%}
29
+ {%- endfor -%}
30
+ {{- '</tools></tool_response>' -}}
31
+ {%- endmacro -%}
32
+ <|system|>
33
+ # Tools
34
+
35
+ You may call one or more functions to assist with the user query.
36
+
37
+ You are provided with function signatures within <tools></tools> XML tags:
38
+ <tools>
39
+ {% for tool in tools %}
40
+ {%- if 'function' in tool -%}
41
+ {%- set tool = tool['function'] -%}
42
+ {%- endif -%}
43
+ {% if tool.defer_loading is not defined or not tool.defer_loading %}
44
+ {{ tool_to_json(tool) }}
45
+ {% endif %}
46
+ {% endfor %}
47
+ </tools>
48
+
49
+ For each function call, output the function name and arguments within the following XML format:
50
+ <tool_call>{function-name}<arg_key>{arg-key-1}</arg_key><arg_value>{arg-value-1}</arg_value><arg_key>{arg-key-2}</arg_key><arg_value>{arg-value-2}</arg_value>...</tool_call>{%- endif -%}
51
+ {%- macro emit_image() -%}<|begin_of_image|><|image|><|end_of_image|>{%- endmacro -%}
52
+ {%- macro emit_video() -%}<|begin_of_video|><|video|><|end_of_video|>{%- endmacro -%}
53
+ {%- macro emit_audio() -%}<|begin_of_audio|><|end_of_audio|>{%- endmacro -%}
54
+ {%- macro visible_text(content) -%}
55
+ {%- if content is string -%}
56
+ {{- content -}}
57
+ {%- elif content is iterable and content is not mapping -%}
58
+ {%- for item in content -%}
59
+ {%- if item is mapping and item.type == 'text' -%}
60
+ {{- item.text -}}
61
+ {%- elif item is string -%}
62
+ {{- item -}}
63
+ {%- elif item is mapping and item.type in ['image', 'image_url'] -%}
64
+ {{- emit_image() -}}
65
+ {%- elif item is mapping and item.type in ['video', 'video_url'] -%}
66
+ {{- emit_video() -}}
67
+ {%- elif item is mapping and item.type in ['audio', 'audio_url', 'input_audio'] -%}
68
+ {{- emit_audio() -}}
69
+ {%- endif -%}
70
+ {%- endfor -%}
71
+ {%- else -%}
72
+ {{- content }}
73
+ {%- endif -%}
74
+ {%- endmacro -%}
75
+ {%- macro tool_response(text) -%}
76
+ {{- '<tool_response>' + text + '</tool_response>' -}}
77
+ {%- endmacro -%}
78
+ {%- macro render_tool_response(m) -%}
79
+ {%- if m.content is string -%}
80
+ {{- tool_response(m.content) -}}
81
+ {%- elif m.content and m.content is not mapping and m.content.0.type == "tool_reference" -%}
82
+ {{- tool_references_to_response(m.content) -}}
83
+ {%- elif is_list_of_outputs(m) -%}
84
+ {%- for tr in m.content -%}
85
+ {%- if tr.output is iterable and tr.output is not string and tr.output is not mapping and tr.output and tr.output.0.type == "tool_reference" -%}
86
+ {{- tool_references_to_response(tr.output) -}}
87
+ {%- else -%}
88
+ {{- tool_response(visible_text(tr.output)) -}}
89
+ {%- endif -%}
90
+ {%- endfor -%}
91
+ {%- else -%}
92
+ {{- tool_response(visible_text(m.content)) -}}
93
+ {%- endif -%}
94
+ {%- endmacro -%}
95
+ {%- macro id_of(obj) -%}
96
+ {%- if obj.tool_call_id -%}
97
+ {{- obj.tool_call_id -}}
98
+ {%- elif obj.id -%}
99
+ {{- obj.id -}}
100
+ {%- endif -%}
101
+ {%- endmacro -%}
102
+ {%- macro is_list_of_outputs(m) -%}
103
+ {%- if m.content and m.content.0.output is defined -%}1{%- endif -%}
104
+ {%- endmacro -%}
105
+ {%- macro has_dup_tool_result_id(lo, hi, target) -%}
106
+ {%- set ns_cnt = namespace(n=0) -%}
107
+ {%- for k in range(lo, hi + 1) -%}
108
+ {%- set m = messages[k] -%}
109
+ {%- if is_list_of_outputs(m) -%}
110
+ {%- for entry in m.content -%}
111
+ {%- if id_of(entry) == target -%}
112
+ {%- set ns_cnt.n = ns_cnt.n + 1 -%}
113
+ {%- endif -%}
114
+ {%- endfor -%}
115
+ {%- elif id_of(m) == target -%}
116
+ {%- set ns_cnt.n = ns_cnt.n + 1 -%}
117
+ {%- endif -%}
118
+ {%- if ns_cnt.n > 1 -%}{%- break -%}{%- endif -%}
119
+ {%- endfor -%}
120
+ {%- if ns_cnt.n > 1 -%}1{%- endif -%}
121
+ {%- endmacro -%}
122
+ {%- macro tc_id_exists(tcs, target) -%}
123
+ {%- set ns_f = namespace(found=false) -%}
124
+ {%- for tc in tcs -%}
125
+ {%- if id_of(tc) == target -%}
126
+ {%- set ns_f.found = true -%}
127
+ {%- break -%}
128
+ {%- endif -%}
129
+ {%- endfor -%}
130
+ {%- if ns_f.found -%}1{%- endif -%}
131
+ {%- endmacro -%}
132
+ {%- set ns = namespace(last_user_index=-1) -%}
133
+ {%- for m in messages %}
134
+ {%- if m.role == 'user' %}
135
+ {%- set ns.last_user_index = loop.index0 -%}
136
+ {%- endif %}
137
+ {%- endfor %}
138
+ {%- for m in messages -%}
139
+ {%- if m.role == 'user' -%}<|user|>{{ visible_text(m.content) }}
140
+ {%- elif m.role == 'assistant' -%}
141
+ <|assistant|>
142
+ {%- set content = visible_text(m.content) %}
143
+ {%- if m.reasoning_content is string %}
144
+ {%- set reasoning_content = m.reasoning_content %}
145
+ {%- elif '</think>' in content %}
146
+ {%- set reasoning_content = content.split('</think>')[0].split('<think>')[-1] %}
147
+ {%- set content = content.split('</think>')[-1] %}
148
+ {%- endif %}
149
+ {%- if (not clear_thinking or loop.index0 > ns.last_user_index) and reasoning_content is defined -%}
150
+ {{ '<think>' + reasoning_content + '</think>'}}
151
+ {%- else -%}
152
+ {{ '<think></think>' }}
153
+ {%- endif -%}
154
+ {%- if content.strip() -%}
155
+ {{ content.strip() }}
156
+ {%- endif -%}
157
+ {% if m.tool_calls %}
158
+ {% for tc in m.tool_calls %}
159
+ {%- if tc.function %}
160
+ {%- set tc = tc.function %}
161
+ {%- endif %}
162
+ {{- '<tool_call>' + tc.name -}}
163
+ {% set _args = tc.arguments %}{% for k, v in _args.items() %}<arg_key>{{ k }}</arg_key><arg_value>{{ v | tojson(ensure_ascii=False) if v is not string else v }}</arg_value>{% endfor %}</tool_call>{% endfor %}
164
+ {% endif %}
165
+ {%- elif m.role == 'tool' -%}
166
+ {%- if loop.first or (messages[loop.index0 - 1].role != "tool") %}
167
+ {{- '<|observation|>' -}}
168
+ {%- set block_start = loop.index0 -%}
169
+ {%- set ns_blk = namespace(end=block_start) -%}
170
+ {%- for j in range(block_start, messages|length) -%}
171
+ {%- if messages[j].role == 'tool' -%}
172
+ {%- set ns_blk.end = j -%}
173
+ {%- else -%}
174
+ {%- break -%}
175
+ {%- endif -%}
176
+ {%- endfor -%}
177
+ {%- set ns_a = namespace(tool_calls=none) -%}
178
+ {%- if block_start > 0 and messages[block_start - 1].role == 'assistant' and messages[block_start - 1].tool_calls -%}
179
+ {%- set ns_a.tool_calls = messages[block_start - 1].tool_calls -%}
180
+ {%- endif -%}
181
+ {%- set ns_chk = namespace(can_sort=true) -%}
182
+ {%- if not ns_a.tool_calls -%}
183
+ {%- set ns_chk.can_sort = false -%}
184
+ {%- else -%}
185
+ {%- for k in range(block_start, ns_blk.end + 1) -%}
186
+ {%- set m = messages[k] -%}
187
+ {%- if is_list_of_outputs(m) -%}
188
+ {%- for entry in m.content -%}
189
+ {%- set eid = id_of(entry) -%}
190
+ {%- if not eid -%}
191
+ {%- set ns_chk.can_sort = false -%}
192
+ {%- elif has_dup_tool_result_id(block_start, ns_blk.end, eid) -%}
193
+ {%- set ns_chk.can_sort = false -%}
194
+ {%- elif not tc_id_exists(ns_a.tool_calls, eid) -%}
195
+ {%- set ns_chk.can_sort = false -%}
196
+ {%- endif -%}
197
+ {%- endfor -%}
198
+ {%- else -%}
199
+ {%- set tk_id = id_of(m) -%}
200
+ {%- if not tk_id -%}
201
+ {%- set ns_chk.can_sort = false -%}
202
+ {%- elif has_dup_tool_result_id(block_start, ns_blk.end, tk_id) -%}
203
+ {%- set ns_chk.can_sort = false -%}
204
+ {%- elif not tc_id_exists(ns_a.tool_calls, tk_id) -%}
205
+ {%- set ns_chk.can_sort = false -%}
206
+ {%- endif -%}
207
+ {%- endif -%}
208
+ {%- endfor -%}
209
+ {%- for i in range(ns_a.tool_calls | length) -%}
210
+ {%- set tc_id = id_of(ns_a.tool_calls[i]) -%}
211
+ {%- if not tc_id -%}
212
+ {%- set ns_chk.can_sort = false -%}
213
+ {%- endif -%}
214
+ {%- for j in range(i + 1, ns_a.tool_calls | length) -%}
215
+ {%- if id_of(ns_a.tool_calls[j]) == tc_id -%}
216
+ {%- set ns_chk.can_sort = false -%}
217
+ {%- endif -%}
218
+ {%- endfor -%}
219
+ {%- endfor -%}
220
+ {%- endif -%}
221
+ {%- if ns_chk.can_sort -%}
222
+ {%- for tc in ns_a.tool_calls -%}
223
+ {%- set tc_id = id_of(tc) -%}
224
+ {%- for k in range(block_start, ns_blk.end + 1) -%}
225
+ {%- set m = messages[k] -%}
226
+ {%- if is_list_of_outputs(m) -%}
227
+ {%- for entry in m.content -%}
228
+ {%- set eid = id_of(entry) -%}
229
+ {%- if eid == tc_id -%}
230
+ {%- if entry.output is iterable and entry.output is not string and entry.output is not mapping and entry.output and entry.output.0.type == "tool_reference" -%}
231
+ {{- tool_references_to_response(entry.output) -}}
232
+ {%- else -%}
233
+ {{- tool_response(visible_text(entry.output)) -}}
234
+ {%- endif -%}
235
+ {%- endif -%}
236
+ {%- endfor -%}
237
+ {%- else -%}
238
+ {%- set tk_id = id_of(m) -%}
239
+ {%- if tk_id == tc_id -%}
240
+ {{- render_tool_response(m) -}}
241
+ {%- endif -%}
242
+ {%- endif -%}
243
+ {%- endfor -%}
244
+ {%- endfor -%}
245
+ {%- else -%}
246
+ {%- for k in range(block_start, ns_blk.end + 1) -%}
247
+ {{- render_tool_response(messages[k]) -}}
248
+ {%- endfor -%}
249
+ {%- endif -%}
250
+ {% endif -%}
251
+ {%- elif m.role == 'system' -%}
252
+ <|system|>{{ visible_text(m.content) }}
253
+ {%- endif -%}
254
+ {%- endfor -%}
255
+ {%- if add_generation_prompt -%}
256
+ <|assistant|>{{- '<think>' -}}
257
+ {%- endif -%}
config.json ADDED
@@ -0,0 +1,469 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "architectures": [
3
+ "Glm5NextForConditionalGeneration"
4
+ ],
5
+ "dtype": "bfloat16",
6
+ "image_end_token_id": 154831,
7
+ "image_start_token_id": 154830,
8
+ "image_token_id": 154854,
9
+ "model_type": "glm5_next",
10
+ "text_config": {
11
+ "attention_bias": false,
12
+ "attention_dropout": 0.0,
13
+ "base_model_ep_plan": {
14
+ "layers.*.mlp.experts": "torch_a2a_experts",
15
+ "layers.*.mlp.experts.down_proj": "grouped_gemm",
16
+ "layers.*.mlp.experts.gate_up_proj": "grouped_gemm",
17
+ "layers.*.mlp.gate": "torch_a2a_router"
18
+ },
19
+ "bos_token_id": null,
20
+ "dtype": "bfloat16",
21
+ "eos_token_id": [
22
+ 154820,
23
+ 154827,
24
+ 154829
25
+ ],
26
+ "first_k_dense_replace": 3,
27
+ "hc_eps": 1e-06,
28
+ "hc_mult": 4,
29
+ "hc_sinkhorn_iters": 20,
30
+ "head_dim": 0,
31
+ "hidden_act": "silu",
32
+ "hidden_size": 4096,
33
+ "index_head_dim": 128,
34
+ "index_kpool": 4,
35
+ "index_kpool_always_select_tail": true,
36
+ "index_kpool_compress": true,
37
+ "index_n_heads": 32,
38
+ "index_share_for_mtp_iteration": true,
39
+ "index_topk": 2048,
40
+ "indexer_rope_interleave": true,
41
+ "indexer_types": [
42
+ "full",
43
+ "full",
44
+ "full",
45
+ "full",
46
+ "full",
47
+ "full",
48
+ "full",
49
+ "full",
50
+ "full",
51
+ "full",
52
+ "full",
53
+ "full",
54
+ "full",
55
+ "full",
56
+ "full",
57
+ "full",
58
+ "full",
59
+ "full",
60
+ "full",
61
+ "full",
62
+ "full",
63
+ "full",
64
+ "full",
65
+ "full",
66
+ "full",
67
+ "full",
68
+ "full",
69
+ "full",
70
+ "full",
71
+ "full",
72
+ "full",
73
+ "full",
74
+ "full",
75
+ "full",
76
+ "full",
77
+ "full",
78
+ "full",
79
+ "full",
80
+ "full",
81
+ "full",
82
+ "full",
83
+ "full",
84
+ "full",
85
+ "full",
86
+ "full"
87
+ ],
88
+ "initializer_range": 0.02,
89
+ "intermediate_size": 12288,
90
+ "kv_lora_rank": 512,
91
+ "layer_types": [
92
+ "linear_attention",
93
+ "linear_attention",
94
+ "linear_attention",
95
+ "deepseek_sparse_attention",
96
+ "linear_attention",
97
+ "linear_attention",
98
+ "linear_attention",
99
+ "deepseek_sparse_attention",
100
+ "linear_attention",
101
+ "linear_attention",
102
+ "linear_attention",
103
+ "deepseek_sparse_attention",
104
+ "linear_attention",
105
+ "linear_attention",
106
+ "linear_attention",
107
+ "deepseek_sparse_attention",
108
+ "linear_attention",
109
+ "linear_attention",
110
+ "linear_attention",
111
+ "deepseek_sparse_attention",
112
+ "linear_attention",
113
+ "linear_attention",
114
+ "linear_attention",
115
+ "deepseek_sparse_attention",
116
+ "linear_attention",
117
+ "linear_attention",
118
+ "linear_attention",
119
+ "deepseek_sparse_attention",
120
+ "linear_attention",
121
+ "linear_attention",
122
+ "linear_attention",
123
+ "deepseek_sparse_attention",
124
+ "linear_attention",
125
+ "linear_attention",
126
+ "linear_attention",
127
+ "deepseek_sparse_attention",
128
+ "linear_attention",
129
+ "linear_attention",
130
+ "linear_attention",
131
+ "deepseek_sparse_attention",
132
+ "linear_attention",
133
+ "linear_attention",
134
+ "linear_attention",
135
+ "deepseek_sparse_attention",
136
+ "linear_attention"
137
+ ],
138
+ "linear_attn_config": {
139
+ "full_attn_layers": [
140
+ 3,
141
+ 7,
142
+ 11,
143
+ 15,
144
+ 19,
145
+ 23,
146
+ 27,
147
+ 31,
148
+ 35,
149
+ 39,
150
+ 43
151
+ ],
152
+ "gate_lower_bound": -5.0,
153
+ "head_dim": 128,
154
+ "kda_layers": [
155
+ 0,
156
+ 1,
157
+ 2,
158
+ 4,
159
+ 5,
160
+ 6,
161
+ 8,
162
+ 9,
163
+ 10,
164
+ 12,
165
+ 13,
166
+ 14,
167
+ 16,
168
+ 17,
169
+ 18,
170
+ 20,
171
+ 21,
172
+ 22,
173
+ 24,
174
+ 25,
175
+ 26,
176
+ 28,
177
+ 29,
178
+ 30,
179
+ 32,
180
+ 33,
181
+ 34,
182
+ 36,
183
+ 37,
184
+ 38,
185
+ 40,
186
+ 41,
187
+ 42,
188
+ 44
189
+ ],
190
+ "num_heads": 64,
191
+ "short_conv_kernel_size": 4
192
+ },
193
+ "linear_conv_kernel_dim": 4,
194
+ "linear_head_dim": 128,
195
+ "linear_lower_bound": -5.0,
196
+ "linear_num_heads": 64,
197
+ "max_position_embeddings": 1048576,
198
+ "mhc": true,
199
+ "mla_use_nope": true,
200
+ "mlp_layer_types": [
201
+ "dense",
202
+ "dense",
203
+ "dense",
204
+ "sparse",
205
+ "sparse",
206
+ "sparse",
207
+ "sparse",
208
+ "sparse",
209
+ "sparse",
210
+ "sparse",
211
+ "sparse",
212
+ "sparse",
213
+ "sparse",
214
+ "sparse",
215
+ "sparse",
216
+ "sparse",
217
+ "sparse",
218
+ "sparse",
219
+ "sparse",
220
+ "sparse",
221
+ "sparse",
222
+ "sparse",
223
+ "sparse",
224
+ "sparse",
225
+ "sparse",
226
+ "sparse",
227
+ "sparse",
228
+ "sparse",
229
+ "sparse",
230
+ "sparse",
231
+ "sparse",
232
+ "sparse",
233
+ "sparse",
234
+ "sparse",
235
+ "sparse",
236
+ "sparse",
237
+ "sparse",
238
+ "sparse",
239
+ "sparse",
240
+ "sparse",
241
+ "sparse",
242
+ "sparse",
243
+ "sparse",
244
+ "sparse",
245
+ "sparse"
246
+ ],
247
+ "model_type": "glm5_next_text",
248
+ "moe_intermediate_size": 2048,
249
+ "moe_router_dtype": "float32",
250
+ "n_group": 1,
251
+ "n_routed_experts": 288,
252
+ "n_shared_experts": 1,
253
+ "norm_topk_prob": true,
254
+ "num_attention_heads": 64,
255
+ "num_experts_per_tok": 8,
256
+ "num_hidden_layers": 45,
257
+ "num_key_value_heads": 64,
258
+ "num_nextn_predict_layers": 1,
259
+ "output_router_logits": false,
260
+ "pad_token_id": 154820,
261
+ "q_lora_rank": 1536,
262
+ "qk_head_dim": 256,
263
+ "qk_nope_head_dim": 256,
264
+ "qk_rope_head_dim": 0,
265
+ "rms_norm_eps": 1e-05,
266
+ "routed_scaling_factor": 2.5,
267
+ "router_aux_loss_coef": 0.001,
268
+ "scoring_func": "sigmoid",
269
+ "swiglu_limit": 10.0,
270
+ "tie_word_embeddings": false,
271
+ "topk_group": 1,
272
+ "topk_method": "noaux_tc",
273
+ "use_cache": true,
274
+ "v_head_dim": 256,
275
+ "vocab_size": 154880
276
+ },
277
+ "tie_word_embeddings": false,
278
+ "transformers_version": "5.16.1",
279
+ "video_end_token_id": 154833,
280
+ "video_start_token_id": 154832,
281
+ "video_token_id": 154855,
282
+ "vision_config": {
283
+ "attention_bias": true,
284
+ "attention_dropout": 0.0,
285
+ "depth": 24,
286
+ "dtype": "bfloat16",
287
+ "hidden_act": "silu",
288
+ "hidden_size": 1024,
289
+ "image_size": 448,
290
+ "in_channels": 3,
291
+ "initializer_range": 0.02,
292
+ "intermediate_size": 4096,
293
+ "model_type": "glm5_next_vision",
294
+ "num_heads": 16,
295
+ "out_hidden_size": 4096,
296
+ "patch_size": 14,
297
+ "projection_intermediate_size": 10240,
298
+ "rms_norm_eps": 1e-05,
299
+ "spatial_merge_size": 2,
300
+ "swiglu_limit": 10.0,
301
+ "temporal_patch_size": 2
302
+ },
303
+ "quantization_config": {
304
+ "config_groups": {
305
+ "group_0": {
306
+ "input_activations": {
307
+ "dynamic": false,
308
+ "num_bits": 4,
309
+ "type": "float",
310
+ "group_size": 16
311
+ },
312
+ "weights": {
313
+ "dynamic": false,
314
+ "num_bits": 4,
315
+ "type": "float",
316
+ "group_size": 16
317
+ },
318
+ "targets": [
319
+ "Linear"
320
+ ]
321
+ }
322
+ },
323
+ "ignore": [
324
+ "lm_head",
325
+ "model.language_model.embed_tokens",
326
+ "model.language_model.layers.0.self_attn*",
327
+ "model.language_model.layers.1.self_attn*",
328
+ "model.language_model.layers.10.mlp.gate",
329
+ "model.language_model.layers.10.mlp.shared_experts*",
330
+ "model.language_model.layers.10.self_attn*",
331
+ "model.language_model.layers.11.mlp.gate",
332
+ "model.language_model.layers.11.mlp.shared_experts*",
333
+ "model.language_model.layers.11.self_attn*",
334
+ "model.language_model.layers.12.mlp.gate",
335
+ "model.language_model.layers.12.mlp.shared_experts*",
336
+ "model.language_model.layers.12.self_attn*",
337
+ "model.language_model.layers.13.mlp.gate",
338
+ "model.language_model.layers.13.mlp.shared_experts*",
339
+ "model.language_model.layers.13.self_attn*",
340
+ "model.language_model.layers.14.mlp.gate",
341
+ "model.language_model.layers.14.mlp.shared_experts*",
342
+ "model.language_model.layers.14.self_attn*",
343
+ "model.language_model.layers.15.mlp.gate",
344
+ "model.language_model.layers.15.mlp.shared_experts*",
345
+ "model.language_model.layers.15.self_attn*",
346
+ "model.language_model.layers.16.mlp.gate",
347
+ "model.language_model.layers.16.mlp.shared_experts*",
348
+ "model.language_model.layers.16.self_attn*",
349
+ "model.language_model.layers.17.mlp.gate",
350
+ "model.language_model.layers.17.mlp.shared_experts*",
351
+ "model.language_model.layers.17.self_attn*",
352
+ "model.language_model.layers.18.mlp.gate",
353
+ "model.language_model.layers.18.mlp.shared_experts*",
354
+ "model.language_model.layers.18.self_attn*",
355
+ "model.language_model.layers.19.mlp.gate",
356
+ "model.language_model.layers.19.mlp.shared_experts*",
357
+ "model.language_model.layers.19.self_attn*",
358
+ "model.language_model.layers.2.self_attn*",
359
+ "model.language_model.layers.20.mlp.gate",
360
+ "model.language_model.layers.20.mlp.shared_experts*",
361
+ "model.language_model.layers.20.self_attn*",
362
+ "model.language_model.layers.21.mlp.gate",
363
+ "model.language_model.layers.21.mlp.shared_experts*",
364
+ "model.language_model.layers.21.self_attn*",
365
+ "model.language_model.layers.22.mlp.gate",
366
+ "model.language_model.layers.22.mlp.shared_experts*",
367
+ "model.language_model.layers.22.self_attn*",
368
+ "model.language_model.layers.23.mlp.gate",
369
+ "model.language_model.layers.23.mlp.shared_experts*",
370
+ "model.language_model.layers.23.self_attn*",
371
+ "model.language_model.layers.24.mlp.gate",
372
+ "model.language_model.layers.24.mlp.shared_experts*",
373
+ "model.language_model.layers.24.self_attn*",
374
+ "model.language_model.layers.25.mlp.gate",
375
+ "model.language_model.layers.25.mlp.shared_experts*",
376
+ "model.language_model.layers.25.self_attn*",
377
+ "model.language_model.layers.26.mlp.gate",
378
+ "model.language_model.layers.26.mlp.shared_experts*",
379
+ "model.language_model.layers.26.self_attn*",
380
+ "model.language_model.layers.27.mlp.gate",
381
+ "model.language_model.layers.27.mlp.shared_experts*",
382
+ "model.language_model.layers.27.self_attn*",
383
+ "model.language_model.layers.28.mlp.gate",
384
+ "model.language_model.layers.28.mlp.shared_experts*",
385
+ "model.language_model.layers.28.self_attn*",
386
+ "model.language_model.layers.29.mlp.gate",
387
+ "model.language_model.layers.29.mlp.shared_experts*",
388
+ "model.language_model.layers.29.self_attn*",
389
+ "model.language_model.layers.3.mlp.gate",
390
+ "model.language_model.layers.3.mlp.shared_experts*",
391
+ "model.language_model.layers.3.self_attn*",
392
+ "model.language_model.layers.30.mlp.gate",
393
+ "model.language_model.layers.30.mlp.shared_experts*",
394
+ "model.language_model.layers.30.self_attn*",
395
+ "model.language_model.layers.31.mlp.gate",
396
+ "model.language_model.layers.31.mlp.shared_experts*",
397
+ "model.language_model.layers.31.self_attn*",
398
+ "model.language_model.layers.32.mlp.gate",
399
+ "model.language_model.layers.32.mlp.shared_experts*",
400
+ "model.language_model.layers.32.self_attn*",
401
+ "model.language_model.layers.33.mlp.gate",
402
+ "model.language_model.layers.33.mlp.shared_experts*",
403
+ "model.language_model.layers.33.self_attn*",
404
+ "model.language_model.layers.34.mlp.gate",
405
+ "model.language_model.layers.34.mlp.shared_experts*",
406
+ "model.language_model.layers.34.self_attn*",
407
+ "model.language_model.layers.35.mlp.gate",
408
+ "model.language_model.layers.35.mlp.shared_experts*",
409
+ "model.language_model.layers.35.self_attn*",
410
+ "model.language_model.layers.36.mlp.gate",
411
+ "model.language_model.layers.36.mlp.shared_experts*",
412
+ "model.language_model.layers.36.self_attn*",
413
+ "model.language_model.layers.37.mlp.gate",
414
+ "model.language_model.layers.37.mlp.shared_experts*",
415
+ "model.language_model.layers.37.self_attn*",
416
+ "model.language_model.layers.38.mlp.gate",
417
+ "model.language_model.layers.38.mlp.shared_experts*",
418
+ "model.language_model.layers.38.self_attn*",
419
+ "model.language_model.layers.39.mlp.gate",
420
+ "model.language_model.layers.39.mlp.shared_experts*",
421
+ "model.language_model.layers.39.self_attn*",
422
+ "model.language_model.layers.4.mlp.gate",
423
+ "model.language_model.layers.4.mlp.shared_experts*",
424
+ "model.language_model.layers.4.self_attn*",
425
+ "model.language_model.layers.40.mlp.gate",
426
+ "model.language_model.layers.40.mlp.shared_experts*",
427
+ "model.language_model.layers.40.self_attn*",
428
+ "model.language_model.layers.41.mlp.gate",
429
+ "model.language_model.layers.41.mlp.shared_experts*",
430
+ "model.language_model.layers.41.self_attn*",
431
+ "model.language_model.layers.42.mlp.gate",
432
+ "model.language_model.layers.42.mlp.shared_experts*",
433
+ "model.language_model.layers.42.self_attn*",
434
+ "model.language_model.layers.43.mlp.gate",
435
+ "model.language_model.layers.43.mlp.shared_experts*",
436
+ "model.language_model.layers.43.self_attn*",
437
+ "model.language_model.layers.44.mlp.gate",
438
+ "model.language_model.layers.44.mlp.shared_experts*",
439
+ "model.language_model.layers.44.self_attn*",
440
+ "model.language_model.layers.5.mlp.gate",
441
+ "model.language_model.layers.5.mlp.shared_experts*",
442
+ "model.language_model.layers.5.self_attn*",
443
+ "model.language_model.layers.6.mlp.gate",
444
+ "model.language_model.layers.6.mlp.shared_experts*",
445
+ "model.language_model.layers.6.self_attn*",
446
+ "model.language_model.layers.7.mlp.gate",
447
+ "model.language_model.layers.7.mlp.shared_experts*",
448
+ "model.language_model.layers.7.self_attn*",
449
+ "model.language_model.layers.8.mlp.gate",
450
+ "model.language_model.layers.8.mlp.shared_experts*",
451
+ "model.language_model.layers.8.self_attn*",
452
+ "model.language_model.layers.9.mlp.gate",
453
+ "model.language_model.layers.9.mlp.shared_experts*",
454
+ "model.language_model.layers.9.self_attn*",
455
+ "model.visual*"
456
+ ],
457
+ "quant_algo": "NVFP4",
458
+ "kv_cache_scheme": {
459
+ "dynamic": false,
460
+ "num_bits": 8,
461
+ "type": "float"
462
+ },
463
+ "producer": {
464
+ "name": "modelopt",
465
+ "version": "0.47.0.dev393+ga4bc45b30.d20260828"
466
+ },
467
+ "quant_method": "modelopt"
468
+ }
469
+ }
generation_config.json ADDED
@@ -0,0 +1,13 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "_from_model_config": true,
3
+ "do_sample": true,
4
+ "eos_token_id": [
5
+ 154820,
6
+ 154827,
7
+ 154829
8
+ ],
9
+ "pad_token_id": 154820,
10
+ "temperature": 1.0,
11
+ "top_p": 0.95,
12
+ "transformers_version": "5.16.1"
13
+ }
hf_quant_config.json ADDED
@@ -0,0 +1,145 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "producer": {
3
+ "name": "modelopt",
4
+ "version": "0.47.0.dev393+ga4bc45b30.d20260828"
5
+ },
6
+ "quantization": {
7
+ "quant_algo": "NVFP4",
8
+ "kv_cache_quant_algo": "FP8",
9
+ "group_size": 16,
10
+ "exclude_modules": [
11
+ "lm_head",
12
+ "model.language_model.embed_tokens",
13
+ "model.language_model.layers.0.self_attn*",
14
+ "model.language_model.layers.1.self_attn*",
15
+ "model.language_model.layers.10.mlp.gate",
16
+ "model.language_model.layers.10.mlp.shared_experts*",
17
+ "model.language_model.layers.10.self_attn*",
18
+ "model.language_model.layers.11.mlp.gate",
19
+ "model.language_model.layers.11.mlp.shared_experts*",
20
+ "model.language_model.layers.11.self_attn*",
21
+ "model.language_model.layers.12.mlp.gate",
22
+ "model.language_model.layers.12.mlp.shared_experts*",
23
+ "model.language_model.layers.12.self_attn*",
24
+ "model.language_model.layers.13.mlp.gate",
25
+ "model.language_model.layers.13.mlp.shared_experts*",
26
+ "model.language_model.layers.13.self_attn*",
27
+ "model.language_model.layers.14.mlp.gate",
28
+ "model.language_model.layers.14.mlp.shared_experts*",
29
+ "model.language_model.layers.14.self_attn*",
30
+ "model.language_model.layers.15.mlp.gate",
31
+ "model.language_model.layers.15.mlp.shared_experts*",
32
+ "model.language_model.layers.15.self_attn*",
33
+ "model.language_model.layers.16.mlp.gate",
34
+ "model.language_model.layers.16.mlp.shared_experts*",
35
+ "model.language_model.layers.16.self_attn*",
36
+ "model.language_model.layers.17.mlp.gate",
37
+ "model.language_model.layers.17.mlp.shared_experts*",
38
+ "model.language_model.layers.17.self_attn*",
39
+ "model.language_model.layers.18.mlp.gate",
40
+ "model.language_model.layers.18.mlp.shared_experts*",
41
+ "model.language_model.layers.18.self_attn*",
42
+ "model.language_model.layers.19.mlp.gate",
43
+ "model.language_model.layers.19.mlp.shared_experts*",
44
+ "model.language_model.layers.19.self_attn*",
45
+ "model.language_model.layers.2.self_attn*",
46
+ "model.language_model.layers.20.mlp.gate",
47
+ "model.language_model.layers.20.mlp.shared_experts*",
48
+ "model.language_model.layers.20.self_attn*",
49
+ "model.language_model.layers.21.mlp.gate",
50
+ "model.language_model.layers.21.mlp.shared_experts*",
51
+ "model.language_model.layers.21.self_attn*",
52
+ "model.language_model.layers.22.mlp.gate",
53
+ "model.language_model.layers.22.mlp.shared_experts*",
54
+ "model.language_model.layers.22.self_attn*",
55
+ "model.language_model.layers.23.mlp.gate",
56
+ "model.language_model.layers.23.mlp.shared_experts*",
57
+ "model.language_model.layers.23.self_attn*",
58
+ "model.language_model.layers.24.mlp.gate",
59
+ "model.language_model.layers.24.mlp.shared_experts*",
60
+ "model.language_model.layers.24.self_attn*",
61
+ "model.language_model.layers.25.mlp.gate",
62
+ "model.language_model.layers.25.mlp.shared_experts*",
63
+ "model.language_model.layers.25.self_attn*",
64
+ "model.language_model.layers.26.mlp.gate",
65
+ "model.language_model.layers.26.mlp.shared_experts*",
66
+ "model.language_model.layers.26.self_attn*",
67
+ "model.language_model.layers.27.mlp.gate",
68
+ "model.language_model.layers.27.mlp.shared_experts*",
69
+ "model.language_model.layers.27.self_attn*",
70
+ "model.language_model.layers.28.mlp.gate",
71
+ "model.language_model.layers.28.mlp.shared_experts*",
72
+ "model.language_model.layers.28.self_attn*",
73
+ "model.language_model.layers.29.mlp.gate",
74
+ "model.language_model.layers.29.mlp.shared_experts*",
75
+ "model.language_model.layers.29.self_attn*",
76
+ "model.language_model.layers.3.mlp.gate",
77
+ "model.language_model.layers.3.mlp.shared_experts*",
78
+ "model.language_model.layers.3.self_attn*",
79
+ "model.language_model.layers.30.mlp.gate",
80
+ "model.language_model.layers.30.mlp.shared_experts*",
81
+ "model.language_model.layers.30.self_attn*",
82
+ "model.language_model.layers.31.mlp.gate",
83
+ "model.language_model.layers.31.mlp.shared_experts*",
84
+ "model.language_model.layers.31.self_attn*",
85
+ "model.language_model.layers.32.mlp.gate",
86
+ "model.language_model.layers.32.mlp.shared_experts*",
87
+ "model.language_model.layers.32.self_attn*",
88
+ "model.language_model.layers.33.mlp.gate",
89
+ "model.language_model.layers.33.mlp.shared_experts*",
90
+ "model.language_model.layers.33.self_attn*",
91
+ "model.language_model.layers.34.mlp.gate",
92
+ "model.language_model.layers.34.mlp.shared_experts*",
93
+ "model.language_model.layers.34.self_attn*",
94
+ "model.language_model.layers.35.mlp.gate",
95
+ "model.language_model.layers.35.mlp.shared_experts*",
96
+ "model.language_model.layers.35.self_attn*",
97
+ "model.language_model.layers.36.mlp.gate",
98
+ "model.language_model.layers.36.mlp.shared_experts*",
99
+ "model.language_model.layers.36.self_attn*",
100
+ "model.language_model.layers.37.mlp.gate",
101
+ "model.language_model.layers.37.mlp.shared_experts*",
102
+ "model.language_model.layers.37.self_attn*",
103
+ "model.language_model.layers.38.mlp.gate",
104
+ "model.language_model.layers.38.mlp.shared_experts*",
105
+ "model.language_model.layers.38.self_attn*",
106
+ "model.language_model.layers.39.mlp.gate",
107
+ "model.language_model.layers.39.mlp.shared_experts*",
108
+ "model.language_model.layers.39.self_attn*",
109
+ "model.language_model.layers.4.mlp.gate",
110
+ "model.language_model.layers.4.mlp.shared_experts*",
111
+ "model.language_model.layers.4.self_attn*",
112
+ "model.language_model.layers.40.mlp.gate",
113
+ "model.language_model.layers.40.mlp.shared_experts*",
114
+ "model.language_model.layers.40.self_attn*",
115
+ "model.language_model.layers.41.mlp.gate",
116
+ "model.language_model.layers.41.mlp.shared_experts*",
117
+ "model.language_model.layers.41.self_attn*",
118
+ "model.language_model.layers.42.mlp.gate",
119
+ "model.language_model.layers.42.mlp.shared_experts*",
120
+ "model.language_model.layers.42.self_attn*",
121
+ "model.language_model.layers.43.mlp.gate",
122
+ "model.language_model.layers.43.mlp.shared_experts*",
123
+ "model.language_model.layers.43.self_attn*",
124
+ "model.language_model.layers.44.mlp.gate",
125
+ "model.language_model.layers.44.mlp.shared_experts*",
126
+ "model.language_model.layers.44.self_attn*",
127
+ "model.language_model.layers.5.mlp.gate",
128
+ "model.language_model.layers.5.mlp.shared_experts*",
129
+ "model.language_model.layers.5.self_attn*",
130
+ "model.language_model.layers.6.mlp.gate",
131
+ "model.language_model.layers.6.mlp.shared_experts*",
132
+ "model.language_model.layers.6.self_attn*",
133
+ "model.language_model.layers.7.mlp.gate",
134
+ "model.language_model.layers.7.mlp.shared_experts*",
135
+ "model.language_model.layers.7.self_attn*",
136
+ "model.language_model.layers.8.mlp.gate",
137
+ "model.language_model.layers.8.mlp.shared_experts*",
138
+ "model.language_model.layers.8.self_attn*",
139
+ "model.language_model.layers.9.mlp.gate",
140
+ "model.language_model.layers.9.mlp.shared_experts*",
141
+ "model.language_model.layers.9.self_attn*",
142
+ "model.visual*"
143
+ ]
144
+ }
145
+ }
model-00001-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:5c7ee3e2a0bd7452b7ccea70bd18f7221676a709a3d4c050d1457fa7d7359125
3
+ size 8945680672
model-00002-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:7afab1480693d8a37faba2f092b0626b121f6fce9241478ad95cf857145ddc41
3
+ size 8945659984
model-00003-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:f184e8b75db437579fa571d4693d6fba7a2806e531d3b8e05d13b1dbc0a90142
3
+ size 8945740832
model-00004-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:dd08e62f3f86dad5ac784e68eb956fa20a18bab72d81337d3058af281ce18c93
3
+ size 5985863344
model-00005-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:bc763b5eec6911a7750b6e37d7f499d6226535792be5c7e7a169d1abb09875d6
3
+ size 5985909512
model-00006-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:c7d9597fad87af3b54dbcf994be2b65cd99fc458e392e34f22eeac4af502e4fc
3
+ size 5915365198
model-00007-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:3d0f68feb7fe4cee3bd87a464c845843594e0039124941c2a89e7c1ce9da9e2b
3
+ size 5915359020
model-00008-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:5c4d7657a3d6fe137b9de14a917d84e511fc9b206fe76bd943d1e53deedba857
3
+ size 5915364798
model-00009-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:4770820b433f6ca50c7d30f0b2eaa9df6fd7c095769f51ee46aa519c37e5f7d3
3
+ size 5915358812
model-00010-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:be92de14713dc46c0b0c8c87f1c02395b2eeb6059087c69d0a39d01dee34edd8
3
+ size 5915358494
model-00011-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:a3294966995e1a81525c6a9efdeb6a27c599a4d04b4e3a5342331298a527d0be
3
+ size 5915358332
model-00012-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:4d6f4b1a555377bfa773981a4c0d84a86ee782501613a18a3e86caefbace7f66
3
+ size 5915083008
model-00013-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:d1d5c86fa3566eb099f99677550f44191c77faa935491d6d2c5a7c337797eaf9
3
+ size 5915639642
model-00014-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:fd6c81655a572a2462dea772bed6fd5114017f12185a619ce693f6b476be5524
3
+ size 5915084432
model-00015-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:6ff8daa650fcfacd509e15be48f4c986ff7dae081a874fcb4c1ee67d3a66487a
3
+ size 5915642946
model-00016-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:286c1a635749f6364c5b4bbab0c7a9eb0916f9421b17f6ade618a5478b25be58
3
+ size 5915084544
model-00017-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:7be78c2466c0c5d4472c1405ff8631b1da1f0dc059e878d3f6f75bf670514b27
3
+ size 5915653746
model-00018-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:b5755440acc16e3a935ab60106a99bc9db6cc03d033786e7502e2010a27ff6aa
3
+ size 5915084536
model-00019-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:2385071e3600654014011755c97a46e1abe1d2aa988e6fdb7aa2bd4c751b9419
3
+ size 5915653908
model-00020-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:8597c39572caa35b1a5e4896ed7c83eb12350ca862dce875071ec2e2d70fec98
3
+ size 5915368968
model-00021-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:cf2923ceb37fd1dcb2772f16aa6d459e472dea3d36275f5c5580781646f27f60
3
+ size 5915366420
model-00022-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:8f27fac338e9960367a58f0a6ba3681148d52bf38d563d183cac5ab7092b16a6
3
+ size 5915362564
model-00023-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:04bbd26640bdf145da1c412aa4c01ef2d0103b2d7e8a2846f207175be461be5d
3
+ size 5915370484
model-00024-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:2dc1b2fdf6ba9816545ce9036c9561cd293f71c887d3d3d1590e86900548fb75
3
+ size 5915084584
model-00025-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:12a327e0f52b18e7feae2936ebacf33f7a5eff11c96038a06d2547f5653f0838
3
+ size 5915652952
model-00026-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:0eb6db2777bebcf9ea34e9b639a8497ffb0d7c520e00a4e0a0b6331cfb18ac2d
3
+ size 5915084552
model-00027-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:e220abe4abb6a4798b1d16fdb7d4f6121b6c6e3e8f8d9f71243ba957a7f9542d
3
+ size 5915652344
model-00028-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:04b44953c3a5019c4da79260b9abf39bc6fa2b9414f4ede20fea400325aaab3d
3
+ size 5915364684
model-00029-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:a705d67e2580270744f26135fc46fd062ea59df6260b45cd628bc2b8a74f6ab2
3
+ size 5915373524
model-00030-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:60c0e12a793693702303e7d0ebf16e7619fbbc7a45fe2e9e6d038459053f8e1f
3
+ size 5915364844
model-00031-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:5d3a07314659b264b56d84385e89abb5a0199ce944a7cb33eab556832d100075
3
+ size 5915373956
model-00032-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:5126cddeb35041953ad0375d926081f7d78b0b279460fa8d1afcdfbe36bca3d1
3
+ size 5915364628
model-00033-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:c6fa7921452627ad9d7913875d78496c60082f71b05f943b5dddb3318f0771c2
3
+ size 5915373132
model.safetensors.index.json ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:26765b2601fd246ef361cfb9f5e10f9fb291a59e05ad0a109062f3a4747c7fd1
3
+ size 16291474
processor_config.json ADDED
@@ -0,0 +1,44 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "image_processor": {
3
+ "do_rescale": true,
4
+ "patch_expand_factor": 1,
5
+ "merge_size": 2,
6
+ "image_mean": [
7
+ 0.48145466,
8
+ 0.4578275,
9
+ 0.40821073
10
+ ],
11
+ "image_std": [
12
+ 0.26862954,
13
+ 0.26130258,
14
+ 0.27577711
15
+ ],
16
+ "temporal_patch_size": 2,
17
+ "patch_size": 14,
18
+ "min_image_tokens": 16,
19
+ "max_image_tokens": 8000,
20
+ "image_processor_type": "Glm5NextImageProcessor"
21
+ },
22
+ "video_processor": {
23
+ "do_rescale": true,
24
+ "video_processor_type": "Glm5NextVideoProcessor",
25
+ "patch_expand_factor": 1,
26
+ "merge_size": 2,
27
+ "image_mean": [
28
+ 0.48145466,
29
+ 0.4578275,
30
+ 0.40821073
31
+ ],
32
+ "image_std": [
33
+ 0.26862954,
34
+ 0.26130258,
35
+ 0.27577711
36
+ ],
37
+ "temporal_patch_size": 2,
38
+ "patch_size": 14,
39
+ "min_image_tokens": 16,
40
+ "max_image_tokens": 240000,
41
+ "fps": 2
42
+ },
43
+ "processor_class": "Glm5NextProcessor"
44
+ }
tokenizer.json ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:19e773648cb4e65de8660ea6365e10acca112d42a854923df93db4a6f333a82d
3
+ size 20217442
tokenizer_config.json ADDED
@@ -0,0 +1,33 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "backend": "tokenizers",
3
+ "clean_up_tokenization_spaces": false,
4
+ "do_lower_case": false,
5
+ "eos_token": "<|endoftext|>",
6
+ "extra_special_tokens": [
7
+ "<|endoftext|>",
8
+ "[MASK]",
9
+ "[gMASK]",
10
+ "[sMASK]",
11
+ "<sop>",
12
+ "<eop>",
13
+ "<|system|>",
14
+ "<|user|>",
15
+ "<|assistant|>",
16
+ "<|observation|>",
17
+ "<|begin_of_image|>",
18
+ "<|end_of_image|>",
19
+ "<|begin_of_video|>",
20
+ "<|end_of_video|>",
21
+ "<|begin_of_audio|>",
22
+ "<|end_of_audio|>",
23
+ "<|begin_of_transcription|>",
24
+ "<|end_of_transcription|>"
25
+ ],
26
+ "is_local": true,
27
+ "model_max_length": 1048576,
28
+ "model_specific_special_tokens": {},
29
+ "pad_token": "<|endoftext|>",
30
+ "padding_side": "left",
31
+ "remove_space": false,
32
+ "tokenizer_class": "TokenizersBackend"
33
+ }