Clemylia commited on
Commit
ba9ac71
·
verified ·
1 Parent(s): 2d5d36c

Upload folder using huggingface_hub

Browse files
README.md ADDED
@@ -0,0 +1,92 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ ---
2
+ license: other
3
+ datasets:
4
+ - Clemylia/Iris-data
5
+ language:
6
+ - fr
7
+ pipeline_tag: text-generation
8
+ tags:
9
+ - SLM
10
+ - "Iris la gu\xEApe"
11
+ - Gentillesse
12
+ - "Amiti\xE9"
13
+ - "Cr\xE9ativit\xE9"
14
+ library_name: transformers.js
15
+ base_model:
16
+ - LLM-CLEM/Iris-La-guepe
17
+ ---
18
+
19
+
20
+
21
+ # Iris-La-guepe (ONNX)
22
+
23
+
24
+ This is an ONNX version of [LLM-CLEM/Iris-La-guepe](https://huggingface.co/LLM-CLEM/Iris-La-guepe). It was automatically converted and uploaded using [this Hugging Face Space](https://huggingface.co/spaces/onnx-community/convert-to-onnx).
25
+
26
+
27
+ ## Usage with Transformers.js
28
+
29
+
30
+ See the pipeline documentation for `text-generation`: https://huggingface.co/docs/transformers.js/api/pipelines#module_pipelines.TextGenerationPipeline
31
+
32
+
33
+ ---
34
+
35
+
36
+ # 🐝 Documentation Utilisateur : Modèle "Iris la Guêpe" 🦋
37
+
38
+ ![Iris](http://www.image-heberg.fr/files/1763914946721429077.jpg)
39
+
40
+ Bienvenue dans l'univers de la **Guêpe aux Cheveux Bleus** ! Ce modèle d'intelligence artificielle a été spécialement entraîné pour générer des récits, des dialogues et des concepts originaux basés sur l'histoire d'Iris, sa famille (Julia et Anya) et les colonies d'abeilles.
41
+
42
+ Notre modèle excelle dans la création de **néologismes** — des mots inventés — qui donnent un ton unique et poétique à chaque interaction.
43
+
44
+ ## 🎯 Quel est le But de ce Modèle ?
45
+
46
+ Ce modèle est votre **Partenaire Narratif** ! Il est conçu pour :
47
+
48
+ * **Enrichir** vos histoires et jeux de rôle.
49
+ * **Générer** des dialogues complexes et émotionnels.
50
+ * **Créer** un vocabulaire unique (néologismes) pour un univers fantastique et thématique (guêpes et abeilles).
51
+
52
+ ## ✍️ Comment Interagir avec le Modèle ?
53
+
54
+ Pour obtenir les meilleures réponses, structurez votre requête en incluant les éléments clés de l'univers.
55
+
56
+ ### 1. 🌟 Le Thème (Le Contexte)
57
+
58
+ Décrivez la scène, le personnage ou le conflit que vous souhaitez explorer.
59
+
60
+ | Personnage / Lieu | Description | Exemple de Thème |
61
+ | :--- | :--- | :--- |
62
+ | **Iris** 🦋 | Paix, douceur, gentillesse, exil, abeilles. | *Décris une journée d'Iris aidant les abeilles.* |
63
+ | **Julia** 👑 | Colère, autorité, solitude, règles strictes. | *Quel est le dialogue intérieur de Julia après une défaite ?* |
64
+ | **Anya** 🖤 | Conflit intérieur, loyauté, doute, trahison. | *Anya découvre un souvenir de son enfance avec Iris.* |
65
+ | **Les Abeilles** 🍯 | Communauté, travail, accueil, méfiance. | *Les abeilles réagissent à l'arrivée d'une guêpe.* |
66
+
67
+ ### 2. ✨ Le Néologisme (L'Attente Créative)
68
+
69
+ Pour garantir une sortie unique, vous pouvez demander explicitement au modèle de créer un mot sur un concept donné.
70
+
71
+ | Demande Utilisateur | Sortie Attendue |
72
+ | :--- | :--- |
73
+ | `Néologisme pour 'courage'.` | Le mot généré (ex: **force-douce**). |
74
+ | `Utilise un néologisme pour 'amitié'.` | Une phrase contenant le mot (ex: **amitiéternel**). |
75
+
76
+ ## 💡 Exemples de Requêtes Efficaces
77
+
78
+ Utilisez les balises pour orienter clairement le modèle sur ce que vous attendez.
79
+
80
+ | Type de Requête | Exemple de Requête | Sortie Type (Exemple) |
81
+ | :--- | :--- | :--- |
82
+ | **Dialogue** 💬 | Dialogue entre Iris et Julia sur le **pardon**. Donne un néologisme pour **justice**. | *Iris : La seule **justicelle** est le **pardonisme**.* |
83
+ | **Mini-Récit** 📜 | Mini-récit sur Anya qui s'interroge sur la **loyauté**. Donne un néologisme pour **dilemme**. | *Elle était face à l'**impossibilisme**, un **choix-corne**. La **loyauté-sang** la déchirait.* |
84
+ | **Description** 🌈 | Décris l'odeur du nid des guêpes qui change. Néologisme pour **changement**. | *Le **changement-subtil** était là. L'odeur de venin était contaminée par le **doute-pollen**.* |
85
+
86
+ ## ⚠️ Notes et Limites du Modèle
87
+
88
+ Comme il est très spécialisé, veuillez noter ce qui suit :
89
+
90
+ * **Concentration Contextuelle :** Si vous parlez de sujets non liés aux guêpes, aux abeilles, ou aux concepts de l'univers d'Iris, le modèle essaiera poliment de ramener la conversation vers ces thèmes.
91
+ * **Syntaxe Créative :** Le modèle peut parfois générer des phrases à la syntaxe unique ou légèrement fragmentée (voir Exemples 1 et 3 ci-dessus). C'est un effet secondaire de l'apprentissage intensif des néologismes, ce qui contribue à son style **poétique et distinctif**.
92
+ * **Évitez les Sujets Hors Thème :** Ne demandez jamais des recettes, des données mathématiques complexes ou des informations générales ; il ne parlera que de l'histoire d'Iris !
added_tokens.json ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ {
2
+ "[PAD]": 50257
3
+ }
config.json ADDED
@@ -0,0 +1,35 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "_attn_implementation_autoset": true,
3
+ "_name_or_path": "LLM-CLEM/Iris-La-guepe",
4
+ "activation_function": "gelu_new",
5
+ "architectures": [
6
+ "GPT2LMHeadModel"
7
+ ],
8
+ "attn_pdrop": 0.1,
9
+ "bos_token_id": 50256,
10
+ "dtype": "float32",
11
+ "embd_pdrop": 0.1,
12
+ "eos_token_id": 50256,
13
+ "initializer_range": 0.02,
14
+ "layer_norm_epsilon": 1e-05,
15
+ "model_type": "gpt2",
16
+ "n_embd": 512,
17
+ "n_head": 8,
18
+ "n_inner": null,
19
+ "n_layer": 8,
20
+ "n_positions": 128,
21
+ "pad_token_id": 50257,
22
+ "reorder_and_upcast_attn": false,
23
+ "resid_pdrop": 0.1,
24
+ "scale_attn_by_inverse_layer_idx": false,
25
+ "scale_attn_weights": true,
26
+ "summary_activation": null,
27
+ "summary_first_dropout": 0.1,
28
+ "summary_proj_to_labels": true,
29
+ "summary_type": "cls_index",
30
+ "summary_use_proj": true,
31
+ "torch_dtype": "float32",
32
+ "transformers_version": "4.49.0",
33
+ "use_cache": true,
34
+ "vocab_size": 50258
35
+ }
generation_config.json ADDED
@@ -0,0 +1,9 @@
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "_from_model_config": true,
3
+ "bos_token_id": 50256,
4
+ "eos_token_id": [
5
+ 50256
6
+ ],
7
+ "pad_token_id": 50257,
8
+ "transformers_version": "4.49.0"
9
+ }
merges.txt ADDED
The diff for this file is too large to render. See raw diff
 
onnx/model.onnx ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:5d62b38f41eef1912df272fdaf07725cff6448c41afbf70a96751116054fa136
3
+ size 204300051
onnx/model_bnb4.onnx ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:55973380d27b0647dadec07d92bb556aaa8c6313bfc20f8806de4a4da02ff7c6
3
+ size 204300070
onnx/model_fp16.onnx ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:9cc42153cd7d346a1c509238135b064a8f529fe3a449f22f3269d0916c9d2779
3
+ size 102268734
onnx/model_int8.onnx ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:ff275d09f67fdaa583a2c2c76be60e6483522f009600303679082037ed189cb7
3
+ size 154386871
onnx/model_q4.onnx ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:55973380d27b0647dadec07d92bb556aaa8c6313bfc20f8806de4a4da02ff7c6
3
+ size 204300070
onnx/model_q4f16.onnx ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:65648bacd5f6cee4548d85e5bb5e1a8f5460e8acb7b2cd0e86de4278c11c6a34
3
+ size 102268753
onnx/model_quantized.onnx ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:ff275d09f67fdaa583a2c2c76be60e6483522f009600303679082037ed189cb7
3
+ size 154386871
onnx/model_uint8.onnx ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:af41a98da404614a8ff05f5ba254eb7dbce70a829d9c1d741069601c94bb8bca
3
+ size 154386888
quantize_config.json ADDED
@@ -0,0 +1,18 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "modes": [
3
+ "fp16",
4
+ "q8",
5
+ "int8",
6
+ "uint8",
7
+ "q4",
8
+ "q4f16",
9
+ "bnb4"
10
+ ],
11
+ "per_channel": false,
12
+ "reduce_range": false,
13
+ "block_size": null,
14
+ "is_symmetric": true,
15
+ "accuracy_level": null,
16
+ "quant_type": 1,
17
+ "op_block_list": null
18
+ }
special_tokens_map.json ADDED
@@ -0,0 +1,30 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "bos_token": {
3
+ "content": "<|endoftext|>",
4
+ "lstrip": false,
5
+ "normalized": true,
6
+ "rstrip": false,
7
+ "single_word": false
8
+ },
9
+ "eos_token": {
10
+ "content": "<|endoftext|>",
11
+ "lstrip": false,
12
+ "normalized": true,
13
+ "rstrip": false,
14
+ "single_word": false
15
+ },
16
+ "pad_token": {
17
+ "content": "[PAD]",
18
+ "lstrip": false,
19
+ "normalized": false,
20
+ "rstrip": false,
21
+ "single_word": false
22
+ },
23
+ "unk_token": {
24
+ "content": "<|endoftext|>",
25
+ "lstrip": false,
26
+ "normalized": true,
27
+ "rstrip": false,
28
+ "single_word": false
29
+ }
30
+ }
tokenizer.json ADDED
The diff for this file is too large to render. See raw diff
 
tokenizer_config.json ADDED
@@ -0,0 +1,37 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "add_prefix_space": false,
3
+ "added_tokens_decoder": {
4
+ "50256": {
5
+ "content": "<|endoftext|>",
6
+ "lstrip": false,
7
+ "normalized": true,
8
+ "rstrip": false,
9
+ "single_word": false,
10
+ "special": true
11
+ },
12
+ "50257": {
13
+ "content": "[PAD]",
14
+ "lstrip": false,
15
+ "normalized": false,
16
+ "rstrip": false,
17
+ "single_word": false,
18
+ "special": true
19
+ }
20
+ },
21
+ "bos_token": "<|endoftext|>",
22
+ "chat_template": "{%- for message in messages -%}\n {{ '### Instruction:\\n' + message.content + '\\n\\n' }}\n{%- endfor -%}\n{{ '### Response:\\n' }}",
23
+ "clean_up_tokenization_spaces": false,
24
+ "eos_token": "<|endoftext|>",
25
+ "extra_special_tokens": {},
26
+ "max_length": 128,
27
+ "model_max_length": 1024,
28
+ "pad_to_multiple_of": null,
29
+ "pad_token": "[PAD]",
30
+ "pad_token_type_id": 0,
31
+ "padding_side": "right",
32
+ "stride": 0,
33
+ "tokenizer_class": "GPT2Tokenizer",
34
+ "truncation_side": "right",
35
+ "truncation_strategy": "longest_first",
36
+ "unk_token": "<|endoftext|>"
37
+ }
vocab.json ADDED
The diff for this file is too large to render. See raw diff