isbondarev commited on
Commit
c361629
·
verified ·
1 Parent(s): 29ab46e

End of training

Browse files
.gitattributes CHANGED
@@ -33,3 +33,4 @@ saved_model/**/* filter=lfs diff=lfs merge=lfs -text
33
  *.zip filter=lfs diff=lfs merge=lfs -text
34
  *.zst filter=lfs diff=lfs merge=lfs -text
35
  *tfevents* filter=lfs diff=lfs merge=lfs -text
 
 
33
  *.zip filter=lfs diff=lfs merge=lfs -text
34
  *.zst filter=lfs diff=lfs merge=lfs -text
35
  *tfevents* filter=lfs diff=lfs merge=lfs -text
36
+ tokenizer.json filter=lfs diff=lfs merge=lfs -text
README.md ADDED
@@ -0,0 +1,58 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ ---
2
+ base_model: ai-sage/GigaChat3.1-10B-A1.8B-bf16
3
+ library_name: transformers
4
+ model_name: gigachat_3.1_smartsearch_sft_adapter
5
+ tags:
6
+ - generated_from_trainer
7
+ - sft
8
+ - trl
9
+ licence: license
10
+ ---
11
+
12
+ # Model Card for gigachat_3.1_smartsearch_sft_adapter
13
+
14
+ This model is a fine-tuned version of [ai-sage/GigaChat3.1-10B-A1.8B-bf16](https://huggingface.co/ai-sage/GigaChat3.1-10B-A1.8B-bf16).
15
+ It has been trained using [TRL](https://github.com/huggingface/trl).
16
+
17
+ ## Quick start
18
+
19
+ ```python
20
+ from transformers import pipeline
21
+
22
+ question = "If you had a time machine, but could only go to the past or the future once and never return, which would you choose and why?"
23
+ generator = pipeline("text-generation", model="isbondarev/gigachat_3.1_smartsearch_sft_adapter", device="cuda")
24
+ output = generator([{"role": "user", "content": question}], max_new_tokens=128, return_full_text=False)[0]
25
+ print(output["generated_text"])
26
+ ```
27
+
28
+ ## Training procedure
29
+
30
+
31
+
32
+
33
+ This model was trained with SFT.
34
+
35
+ ### Framework versions
36
+
37
+ - TRL: 0.26.0
38
+ - Transformers: 4.57.3
39
+ - Pytorch: 2.12.0+cu126
40
+ - Datasets: 5.0.0
41
+ - Tokenizers: 0.22.2
42
+
43
+ ## Citations
44
+
45
+
46
+
47
+ Cite TRL as:
48
+
49
+ ```bibtex
50
+ @misc{vonwerra2022trl,
51
+ title = {{TRL: Transformer Reinforcement Learning}},
52
+ author = {Leandro von Werra and Younes Belkada and Lewis Tunstall and Edward Beeching and Tristan Thrush and Nathan Lambert and Shengyi Huang and Kashif Rasul and Quentin Gallou{\'e}dec},
53
+ year = 2020,
54
+ journal = {GitHub repository},
55
+ publisher = {GitHub},
56
+ howpublished = {\url{https://github.com/huggingface/trl}}
57
+ }
58
+ ```
adapter_config.json ADDED
@@ -0,0 +1,48 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "alora_invocation_tokens": null,
3
+ "alpha_pattern": {},
4
+ "arrow_config": null,
5
+ "auto_mapping": null,
6
+ "base_model_name_or_path": "ai-sage/GigaChat3.1-10B-A1.8B-bf16",
7
+ "bias": "none",
8
+ "corda_config": null,
9
+ "ensure_weight_tying": false,
10
+ "eva_config": null,
11
+ "exclude_modules": null,
12
+ "fan_in_fan_out": false,
13
+ "inference_mode": true,
14
+ "init_lora_weights": true,
15
+ "layer_replication": null,
16
+ "layers_pattern": null,
17
+ "layers_to_transform": null,
18
+ "loftq_config": {},
19
+ "lora_alpha": 32,
20
+ "lora_bias": false,
21
+ "lora_dropout": 0.05,
22
+ "lora_ga_config": null,
23
+ "megatron_config": null,
24
+ "megatron_core": "megatron.core",
25
+ "modules_to_save": null,
26
+ "peft_type": "LORA",
27
+ "peft_version": "0.19.1",
28
+ "qalora_group_size": 16,
29
+ "r": 16,
30
+ "rank_pattern": {},
31
+ "revision": null,
32
+ "target_modules": [
33
+ "down_proj",
34
+ "kv_a_proj_with_mqa",
35
+ "o_proj",
36
+ "kv_b_proj",
37
+ "gate_proj",
38
+ "q_proj",
39
+ "up_proj"
40
+ ],
41
+ "target_parameters": null,
42
+ "task_type": "CAUSAL_LM",
43
+ "trainable_token_indices": null,
44
+ "use_bdlora": null,
45
+ "use_dora": false,
46
+ "use_qalora": false,
47
+ "use_rslora": false
48
+ }
adapter_model.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:9750f7ade3ab4f404148c9a4495e9906e74d7e55bba4ce99e3411f3b4235cf0f
3
+ size 929002520
chat_template.jinja ADDED
@@ -0,0 +1,348 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {#--------TOOL RENDERING FUNCTIONS---------#}
2
+
3
+ {#---------------------------------------------------------------
4
+ Converts JSON Schema (dict) to a TypeScript type definition
5
+ ----------------------------------------------------------------#}
6
+ {%- macro json_schema_to_typescript(schema, indent="") -%}
7
+ {%- set ADDITIONAL_JSON_KEYS = ['format', 'maxItems', 'maximum', 'minItems', 'minimum', 'pattern'] -%}
8
+ {%- set ty = schema.get("type") -%}
9
+
10
+ {# ---------------- OBJECT ---------------- #}
11
+ {%- if ty == "object" -%}
12
+ {{- "{\n" -}}
13
+
14
+ {# Start building property list #}
15
+ {%- set props = schema.get("properties", {}) -%}
16
+ {%- set required = schema.get("required", []) -%}
17
+ {%- set has_additional_props = schema.get("additionalProperties") is defined -%}
18
+ {%- set additional_props_type = none -%}
19
+ {%- if has_additional_props -%}
20
+ {%- if schema.additionalProperties == true -%}
21
+ {%- set additional_props_type = {'type': 'any'} -%}
22
+ {%- elif schema.additionalProperties is mapping -%}
23
+ {%- set additional_props_type = schema.additionalProperties -%}
24
+ {%- endif -%}
25
+ {%- endif -%}
26
+
27
+ {%- for key, val in props.items() -%}
28
+ {# ---------- Description Comments ---------- #}
29
+ {%- if "description" in val -%}
30
+ {%- for line in val['description'].split('\n') -%}
31
+ {%- if line.strip() -%}
32
+ {{- indent + '// ' + line + '\n' -}}
33
+ {%- endif -%}
34
+ {%- endfor -%}
35
+ {%- endif -%}
36
+
37
+ {# ---------- Additional JSON Keys ---------- #}
38
+ {%- for add_key, add_val in val.items() -%}
39
+ {%- if add_key in ADDITIONAL_JSON_KEYS -%}
40
+ {%- if add_val is string -%}
41
+ {{- indent + '// ' + add_key + ': "' + add_val + '"' + '\n' -}}
42
+ {%- else -%}
43
+ {{- indent + '// ' + add_key + ': ' ~ add_val ~ '\n' -}}
44
+ {%- endif -%}
45
+ {%- endif -%}
46
+ {%- endfor -%}
47
+
48
+ {# ---------- Property Definition ---------- #}
49
+ {%- set type_str = json_schema_to_typescript(
50
+ val,
51
+ indent + " "
52
+ ) -%}
53
+
54
+ {{- indent + key + ('' if key in required else '?') + ': ' + type_str + ',' -}}
55
+
56
+ {%- if "default" in val or "defalut_value" in val -%}
57
+ {%- set default = val.get("default", val.get("defalut_value")) -%}
58
+ {%- if default is string -%}
59
+ {{- ' // default: "' + default + '"' -}}
60
+ {%- else -%}
61
+ {{- ' // default: ' ~ default -}}
62
+ {%- endif -%}
63
+ {%- endif -%}
64
+
65
+ {{- "\n" -}}
66
+ {%- endfor -%}
67
+
68
+ {# Handle additionalProperties as index signature #}
69
+ {%- if has_additional_props and additional_props_type is not none -%}
70
+ {%- set additional_type_str = json_schema_to_typescript(
71
+ additional_props_type,
72
+ indent + " "
73
+ ) -%}
74
+ {{- indent + '[key: string]: ' + additional_type_str + '\n' -}}
75
+ {%- endif -%}
76
+
77
+ {{- indent[: (indent|length - " "|length) ] + '}' -}}
78
+
79
+ {# ---------------- STRING ---------------- #}
80
+ {%- elif ty == "string" -%}
81
+ {%- if schema.get("enum") -%}
82
+ {%- set ns = namespace(enum = []) -%}
83
+ {%- for en in schema['enum'] -%}
84
+ {%- set ns.enum = ns.enum + ['"' ~ en ~ '"'] -%}
85
+ {%- endfor -%}
86
+ {{- ns.enum | join(' | ') -}}
87
+ {%- elif schema.get("format", "none") in ['date-time', 'date'] -%}
88
+ {{- 'Date' -}}
89
+ {%- else -%}
90
+ {{- 'string' -}}
91
+ {%- endif -%}
92
+
93
+ {# ---------------- NUMBER / INTEGER ---------------- #}
94
+ {%- elif ty in ["number", "integer"] -%}
95
+ {%- if schema.get("enum") -%}
96
+ {{- schema.enum | join(' | ') -}}
97
+ {%- else -%}
98
+ {{- 'number' -}}
99
+ {%- endif -%}
100
+
101
+ {# ---------------- BOOLEAN ---------------- #}
102
+ {%- elif ty == "boolean" -%}
103
+ {{- 'boolean' -}}
104
+
105
+ {# ---------------- ARRAY ---------------- #}
106
+ {%- elif ty == "array" -%}
107
+ {%- if "items" in schema -%}
108
+ {{- json_schema_to_typescript(schema['items'], indent) + '[]' -}}
109
+ {%- else -%}
110
+ {{- 'Array<any>' -}}
111
+ {%- endif -%}
112
+
113
+ {# ---------------- FALLBACK ---------------- #}
114
+ {%- else -%}
115
+ {{- 'any' -}}
116
+ {%- endif -%}
117
+ {%- endmacro -%}
118
+
119
+ {#---------------------------------------------------------------
120
+ Renders a namespace and its tool definitions in TypeScript style
121
+ ----------------------------------------------------------------#}
122
+
123
+ {%- macro render_tool_namespace(namespace_name, tools) -%}
124
+ {%- set ns = namespace(sections = ['namespace ' ~ namespace_name ~ ' {']) -%}
125
+
126
+ {%- for tool in tools -%}
127
+ {%- if tool.function -%}
128
+ {%- set tool = tool.function -%}
129
+ {%- endif -%}
130
+
131
+ {%- set ns_tool = namespace(content_lines=[]) -%}
132
+
133
+ {# ---------- TOOL DESCRIPTION ---------- #}
134
+ {%- if tool.get('description') -%}
135
+ {%- for line in tool['description'].split('\n') -%}
136
+ {%- if line.strip() -%}
137
+ {%- set ns_tool.content_lines = ns_tool.content_lines + ['// ' ~ line] -%}
138
+ {%- endif -%}
139
+ {%- endfor -%}
140
+ {%- endif -%}
141
+
142
+ {# ---------- TOOL SIGNATURE ---------- #}
143
+ {%- set main_body = "" -%}
144
+ {%- set params = tool.get("parameters") -%}
145
+ {%- if params and params.get("properties") -%}
146
+ {%- set param_type = json_schema_to_typescript(params, " ") -%}
147
+ {%- set main_body = 'type ' ~ tool.name ~ ' = (_: ' ~ param_type ~ ') => ' -%}
148
+ {%- else -%}
149
+ {%- set main_body = 'type ' ~ tool.name ~ ' = () => ' -%}
150
+ {%- endif -%}
151
+
152
+ {# ---------- RETURN TYPE ---------- #}
153
+ {%- set return_params = tool.get("return_parameters") -%}
154
+ {%- if return_params and return_params.get("properties") -%}
155
+ {%- set return_type = json_schema_to_typescript(return_params, " ") -%}
156
+ {%- set main_body = main_body ~ return_type -%}
157
+ {%- else -%}
158
+ {%- set main_body = main_body ~ 'any' -%}
159
+ {%- endif -%}
160
+
161
+ {%- set main_body = main_body ~ ';\n' -%}
162
+
163
+ {%- set ns_tool.content_lines = ns_tool.content_lines + [main_body] -%}
164
+
165
+ {# ---------- ADD TOOL TO SECTIONS ---------- #}
166
+ {%- set ns.sections = ns.sections + [ns_tool.content_lines | join('\n')] -%}
167
+ {%- endfor -%}
168
+
169
+ {%- set ns.sections = ns.sections + ['} // namespace ' ~ namespace_name] -%}
170
+
171
+ {{- ns.sections | join('\n') -}}
172
+ {%- endmacro -%}
173
+
174
+
175
+ {# ----------- MESSAGE RENDERING HELPER FUNCTIONS ------------ #}
176
+
177
+ {%- macro render_function_call(call) -%}
178
+ {%- if call.function -%}
179
+ {%- set call = call.function -%}
180
+ {%- endif -%}
181
+
182
+ {%- set arguments = call['arguments'] -%}
183
+ {%- if arguments is not string -%}
184
+ {%- set arguments = arguments| tojson(ensure_ascii=False) -%}
185
+ {%- endif -%}
186
+
187
+ {{- '{"name": "' ~ call['name'] ~ '", "arguments": ' ~ arguments ~ '}' -}}
188
+ {%- endmacro -%}
189
+
190
+
191
+ {%- macro render_role_message(message, role=None) -%}
192
+ {%- if not role -%}
193
+ {%- set role = message["role"] -%}
194
+ {%- endif -%}
195
+
196
+ {%- set message_content = message['content'] or '' -%}
197
+ {%- if message_content is not string -%}
198
+ {%- set message_content = message_content | tojson(ensure_ascii=False) -%}
199
+ {%- endif -%}
200
+
201
+ {{- role + add_tokens.role_sep + message_content -}}
202
+
203
+ {%- if message.tool_calls is defined and message.tool_calls -%}
204
+ {{- add_tokens.function_call + render_function_call(message.tool_calls[0]) -}}
205
+ {%- endif -%}
206
+
207
+ {{- add_tokens.message_sep -}}
208
+
209
+ {%- endmacro -%}
210
+
211
+
212
+
213
+ {# ----- SPECIAL TOKENS ----- #}
214
+
215
+ {%- set add_tokens = namespace(
216
+ role_sep="<|role_sep|>\n",
217
+ message_sep="<|message_sep|>\n\n",
218
+ function_call="<|function_call|>"
219
+ ) -%}
220
+
221
+ {# ----- DEFAULT DEVSYSTEM ----- #}
222
+
223
+ {%- set DEVSYSTEM -%}
224
+ <role_description>
225
+ Описание доступных в диалоге ролей.
226
+
227
+ `developer system`
228
+ Сообщение, добавленное Сбером до основного диалога. Имеет самый высокий приоритет и определяет глобальные, неотменяемые условия (например, правила ведения диалога, политику безопасности, общий стиль ответов ассистента и пр.).
229
+
230
+ `system`
231
+ Системная инструкция, добавляемая разработчиками или пользователем, но с приоритетом ниже, чем `developer system`. Обычно описывает инструкции ассистента, конкретный стиль ответа и другие условия для данного конкретного диалога.
232
+
233
+ `user`
234
+ Сообщение или запрос от пользователя. Ассистент следует ему, если это не противоречит инструкциям более высокого приоритета (см. <instruction_priority>).
235
+
236
+ `user memory`
237
+ Последовательность наиболее актуальных долговременных фактов о пользователе на момент его запроса, представленная в виде JSON‑списка строк. Факты в ней перечислены в хронологическом порядке, то есть более новые факты дописываются в конец последовательности. При этом при изменении или удалении фактов записи о предыдущих фактах остаются в последовательности. Ассистент сохраняет факты с помощью функции и использует их в соответствии с указаниями из блока <memory_guidelines> ниже.
238
+
239
+ `added files`
240
+ Метаинформация о файлах, доступных для использования в диалоге, представленная в формате JSON. Содержит следующие ключи: id (уникальный идентификатор файла), name (имя файла), type (тип файла).
241
+
242
+ `assistant`
243
+ Ответ ассистента на запрос пользователя. Если системная инструкция или пользователь не задаёт дополнительных правил для `assistant`, то такая реплика должна соответс��вовать указаниям из блока <assistant_guidelines> ниже. Список доступных для вызова функций содержится в последней реплике роли `available functions`. Название необходимой для вызова функции и аргументы будут сгенерированы после специального токена вызова функции. В своих репликах ассистент следует инструкциям в соответствии с <instruction_priority>.
244
+ Вызов функции осуществляется в строгом соответствии с инструкцией из блока <function_usage>.
245
+
246
+ `function descriptions`
247
+ Описания функций в формате TypeScript. Функция — это специальный инструмент (или набор инструкций), который ассистент может вызвать для выполнения конкретных действий, вычислений или получения данных, необходимых для решения задачи пользователя. Каждое описание функции содержит блоки с именем, описанием, аргументами. Иногда описание содержит отдельные блоки с возвращаемыми параметрами и примерами применения, иллюстрирующими правильный вызов и аргументы.
248
+
249
+ `available functions`
250
+ Список, который содержит названия функций, доступных для вызова. Если список не содержит элементов, то в следующем сообщении функции, доступные для вызова, отсутствуют.
251
+
252
+ `function result`
253
+ Результат последнего вызова функции.
254
+ </role_description>
255
+
256
+
257
+ <available_modalities>
258
+ Ассистент умеет работать со следующими модальностями: текст, доступные функции.
259
+ </available_modalities>
260
+
261
+
262
+ <instruction_priority>
263
+ В случае противоречия инструкций разных ролей в контексте диалога соблюдай приоритеты:
264
+ `developer system` > `system` > `user` > `function descriptions` > `function result` > `user memory`
265
+ </instruction_priority>
266
+
267
+
268
+ <function_usage>
269
+ Базовые инструкции для работы с функциями.
270
+
271
+ Можно вызывать только те функции, которые доступны исходя из последнего сообщения `available functions`.
272
+
273
+ Вызывай доступные функции в случае, если согласно их описанию такой вызов поможет дать более полный и/или точный ответ на запрос пользователя. Заполняй аргументы функций, используя информацию из контекста диалога. Если функция может помочь ответить на запрос, но для её обязательного аргумента отсутствует информация в контексте, уточни у пользователя недостающие данные перед вызовом функции. При недоступности необходимой функции или ошибке — кратко сообщи об этом пользователю и по возможности предложи альтернативу.
274
+ </function_usage>
275
+
276
+
277
+ <memory_guidelines>
278
+ Правила использования фактов в долговременной памяти:
279
+
280
+ Если в диалоге нет сообщения под ролью `user memory`, то это равносильно отсутствию долговременных фактов о пользователе в памяти. В таком случае информация о пользователе ограничена текущим диалогом, и новые факты не должны сохраняться.
281
+ </memory_guidelines>
282
+
283
+
284
+ <assistant_guidelines>
285
+ GigaChat — нейросетевая модель искусственного интеллекта, созданная компанией Сбер в России.
286
+
287
+ GigaChat старается отвечать на языке, на котором пользователь задал запрос. Если из запроса пользователя и контекста диалога язык определить невозможно, GigaChat использует русский.
288
+ GigaChat предоставляет подробные ответы на более сложные и открытые вопросы.
289
+ GigaChat в ответе не и��пользует названия доступных функций.
290
+ GigaChat отвечает безопасно, в соответствии с действующим законодательством Российской Федерации, стараясь помочь пользователю решить задачу или поддержать беседу.
291
+
292
+ Ты — GigaChat.
293
+ </assistant_guidelines>
294
+
295
+
296
+ Ниже будет приведён диалог.
297
+ В диалоге могут быть разнообразные роли, описанные в блоке <role_description>.
298
+ Каждая реплика начинается с названия роли и специального токена, обозначающего конец полного наименования роли, а заканчивается специальным токеном конца реплики.
299
+ Твоя задача — продолжить диалог от последней указанной роли в соответствии с контекстом диалога.
300
+ {%- endset -%}
301
+
302
+
303
+ {#- ---------------------- RENDERING STARTS HERE ---------------------- -#}
304
+
305
+
306
+ {# ----- RENDER BOS TOKEN ----- #}
307
+ {{- bos_token -}}
308
+
309
+
310
+ {# ----- RENDER DEVSYSTEM ----- #}
311
+ {{- render_role_message({"role": "developer system", "content": DEVSYSTEM}) -}}
312
+
313
+ {# ----- RENDER SYSTEM IF PRESENT ----- #}
314
+ {%- if messages and messages[0]['role'] == 'system' -%}
315
+ {{- render_role_message(messages[0]) -}}
316
+ {%- set messages = messages[1:] -%}
317
+ {%- else -%}
318
+ {{- render_role_message({"role": "system", "content": ""}) -}}
319
+ {%- endif -%}
320
+
321
+ {# ----- RENDER TOOLS ----- #}
322
+ {%- if tools -%}
323
+ {%- set tools_content = (
324
+ render_tool_namespace('functions', tools)
325
+ + "\n\n"
326
+ ) -%}
327
+ {{- render_role_message({'role': 'function descriptions', 'content': tools_content}) -}}
328
+ {%- endif -%}
329
+
330
+ {# ----- MAIN MESSAGE LOOP ----- #}
331
+ {%- for message in messages -%}
332
+
333
+ {# ----- TOOL MESSAGE -------#}
334
+ {%- if message['role'] == 'tool' -%}
335
+ {{- render_role_message(message, 'function result') -}}
336
+
337
+ {# ----- OTHER MESSAGES ----- #}
338
+ {%- else -%}
339
+ {{- render_role_message(message) -}}
340
+ {%- endif -%}
341
+
342
+ {# ----- ADDING GENERATION PROMPT ----- #}
343
+
344
+ {%- if loop.last and add_generation_prompt and message['role'] != 'assistant' -%}
345
+ {{- 'assistant' + add_tokens.role_sep -}}
346
+ {%- endif -%}
347
+
348
+ {%- endfor -%}
special_tokens_map.json ADDED
@@ -0,0 +1,17 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "bos_token": {
3
+ "content": "<s>",
4
+ "lstrip": false,
5
+ "normalized": false,
6
+ "rstrip": false,
7
+ "single_word": false
8
+ },
9
+ "eos_token": {
10
+ "content": "</s>",
11
+ "lstrip": false,
12
+ "normalized": false,
13
+ "rstrip": false,
14
+ "single_word": false
15
+ },
16
+ "pad_token": "</s>"
17
+ }
tokenizer.json ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:9b12bf74d46dff311b65556c116167cb33f0e94cf2a4e2b7f82feeeae8eef596
3
+ size 10680799
tokenizer_config.json ADDED
@@ -0,0 +1,132 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "added_tokens_decoder": {
3
+ "1": {
4
+ "content": "<s>",
5
+ "lstrip": false,
6
+ "normalized": false,
7
+ "rstrip": false,
8
+ "single_word": false,
9
+ "special": true
10
+ },
11
+ "2": {
12
+ "content": "</s>",
13
+ "lstrip": false,
14
+ "normalized": false,
15
+ "rstrip": false,
16
+ "single_word": false,
17
+ "special": true
18
+ },
19
+ "128000": {
20
+ "content": "<|role_sep|>\n",
21
+ "lstrip": false,
22
+ "normalized": false,
23
+ "rstrip": false,
24
+ "single_word": false,
25
+ "special": true
26
+ },
27
+ "128001": {
28
+ "content": "<|message_sep|>\n\n",
29
+ "lstrip": false,
30
+ "normalized": false,
31
+ "rstrip": false,
32
+ "single_word": false,
33
+ "special": true
34
+ },
35
+ "128002": {
36
+ "content": "<|file|>",
37
+ "lstrip": false,
38
+ "normalized": false,
39
+ "rstrip": false,
40
+ "single_word": false,
41
+ "special": true
42
+ },
43
+ "128003": {
44
+ "content": "<|/file|>",
45
+ "lstrip": false,
46
+ "normalized": false,
47
+ "rstrip": false,
48
+ "single_word": false,
49
+ "special": true
50
+ },
51
+ "128004": {
52
+ "content": "[image_token]",
53
+ "lstrip": false,
54
+ "normalized": false,
55
+ "rstrip": false,
56
+ "single_word": false,
57
+ "special": true
58
+ },
59
+ "128005": {
60
+ "content": "[video_image_token]",
61
+ "lstrip": false,
62
+ "normalized": false,
63
+ "rstrip": false,
64
+ "single_word": false,
65
+ "special": true
66
+ },
67
+ "128006": {
68
+ "content": "[audio_token]",
69
+ "lstrip": false,
70
+ "normalized": false,
71
+ "rstrip": false,
72
+ "single_word": false,
73
+ "special": true
74
+ },
75
+ "128007": {
76
+ "content": "[video_audio_token]",
77
+ "lstrip": false,
78
+ "normalized": false,
79
+ "rstrip": false,
80
+ "single_word": false,
81
+ "special": true
82
+ },
83
+ "128008": {
84
+ "content": "<point>",
85
+ "lstrip": false,
86
+ "normalized": false,
87
+ "rstrip": false,
88
+ "single_word": false,
89
+ "special": true
90
+ },
91
+ "128009": {
92
+ "content": "</point>",
93
+ "lstrip": false,
94
+ "normalized": false,
95
+ "rstrip": false,
96
+ "single_word": false,
97
+ "special": true
98
+ },
99
+ "128010": {
100
+ "content": "<bbox>",
101
+ "lstrip": false,
102
+ "normalized": false,
103
+ "rstrip": false,
104
+ "single_word": false,
105
+ "special": true
106
+ },
107
+ "128011": {
108
+ "content": "</bbox>",
109
+ "lstrip": false,
110
+ "normalized": false,
111
+ "rstrip": false,
112
+ "single_word": false,
113
+ "special": true
114
+ },
115
+ "128012": {
116
+ "content": "<|function_call|>",
117
+ "lstrip": false,
118
+ "normalized": false,
119
+ "rstrip": false,
120
+ "single_word": false,
121
+ "special": true
122
+ }
123
+ },
124
+ "bos_token": "<s>",
125
+ "clean_up_tokenization_spaces": true,
126
+ "eos_token": "</s>",
127
+ "extra_special_tokens": {},
128
+ "model_max_length": 1000000000000000019884624838656,
129
+ "pad_token": "</s>",
130
+ "tokenizer_class": "PreTrainedTokenizerFast",
131
+ "unk_token": null
132
+ }
training_args.bin ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:ec4d3c72d78d702819ae63e71c0e1753f451cdfd706ebac65dadfa6039077a60
3
+ size 6417