Reinforcement Learning
Transformers
Safetensors
gpt2
text-generation
trl
ppo
text-generation-inference
Instructions to use KB8407/KoGPT2-PPO with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- Transformers
How to use KB8407/KoGPT2-PPO with Transformers:
# Load model directly from transformers import AutoTokenizer, AutoModelForCausalLM tokenizer = AutoTokenizer.from_pretrained("KB8407/KoGPT2-PPO") model = AutoModelForCausalLM.from_pretrained("KB8407/KoGPT2-PPO", device_map="auto") - Notebooks
- Google Colab
- Kaggle
Update PPO model
Browse files- README.md +3 -3
- config.json +5 -5
- generation_config.json +1 -1
- model.safetensors +2 -2
- tokenizer_config.json +4 -0
README.md
CHANGED
|
@@ -25,7 +25,7 @@ You can then generate text as follows:
|
|
| 25 |
```python
|
| 26 |
from transformers import pipeline
|
| 27 |
|
| 28 |
-
generator = pipeline("text-generation", model="KB8407/
|
| 29 |
outputs = generator("Hello, my llama is cute")
|
| 30 |
```
|
| 31 |
|
|
@@ -35,8 +35,8 @@ If you want to use the model for training or to obtain the outputs from the valu
|
|
| 35 |
from transformers import AutoTokenizer
|
| 36 |
from trl import AutoModelForCausalLMWithValueHead
|
| 37 |
|
| 38 |
-
tokenizer = AutoTokenizer.from_pretrained("KB8407/
|
| 39 |
-
model = AutoModelForCausalLMWithValueHead.from_pretrained("KB8407/
|
| 40 |
|
| 41 |
inputs = tokenizer("Hello, my llama is cute", return_tensors="pt")
|
| 42 |
outputs = model(**inputs, labels=inputs["input_ids"])
|
|
|
|
| 25 |
```python
|
| 26 |
from transformers import pipeline
|
| 27 |
|
| 28 |
+
generator = pipeline("text-generation", model="KB8407/outputs/ppo/final")
|
| 29 |
outputs = generator("Hello, my llama is cute")
|
| 30 |
```
|
| 31 |
|
|
|
|
| 35 |
from transformers import AutoTokenizer
|
| 36 |
from trl import AutoModelForCausalLMWithValueHead
|
| 37 |
|
| 38 |
+
tokenizer = AutoTokenizer.from_pretrained("KB8407/outputs/ppo/final")
|
| 39 |
+
model = AutoModelForCausalLMWithValueHead.from_pretrained("KB8407/outputs/ppo/final")
|
| 40 |
|
| 41 |
inputs = tokenizer("Hello, my llama is cute", return_tensors="pt")
|
| 42 |
outputs = model(**inputs, labels=inputs["input_ids"])
|
config.json
CHANGED
|
@@ -8,9 +8,9 @@
|
|
| 8 |
"author": "Heewon Jeon(madjakarta@gmail.com)",
|
| 9 |
"bos_token_id": 0,
|
| 10 |
"created_date": "2021-04-28",
|
| 11 |
-
"dtype": "
|
| 12 |
"embd_pdrop": 0.1,
|
| 13 |
-
"eos_token_id":
|
| 14 |
"gradient_checkpointing": false,
|
| 15 |
"id2label": {
|
| 16 |
"0": "LABEL_0"
|
|
@@ -28,7 +28,7 @@
|
|
| 28 |
"n_inner": null,
|
| 29 |
"n_layer": 12,
|
| 30 |
"n_positions": 1024,
|
| 31 |
-
"pad_token_id":
|
| 32 |
"reorder_and_upcast_attn": false,
|
| 33 |
"resid_pdrop": 0.1,
|
| 34 |
"scale_attn_by_inverse_layer_idx": false,
|
|
@@ -44,7 +44,7 @@
|
|
| 44 |
"max_length": 50
|
| 45 |
}
|
| 46 |
},
|
| 47 |
-
"transformers_version": "4.57.
|
| 48 |
"use_cache": true,
|
| 49 |
-
"vocab_size":
|
| 50 |
}
|
|
|
|
| 8 |
"author": "Heewon Jeon(madjakarta@gmail.com)",
|
| 9 |
"bos_token_id": 0,
|
| 10 |
"created_date": "2021-04-28",
|
| 11 |
+
"dtype": "float32",
|
| 12 |
"embd_pdrop": 0.1,
|
| 13 |
+
"eos_token_id": 51200,
|
| 14 |
"gradient_checkpointing": false,
|
| 15 |
"id2label": {
|
| 16 |
"0": "LABEL_0"
|
|
|
|
| 28 |
"n_inner": null,
|
| 29 |
"n_layer": 12,
|
| 30 |
"n_positions": 1024,
|
| 31 |
+
"pad_token_id": 51200,
|
| 32 |
"reorder_and_upcast_attn": false,
|
| 33 |
"resid_pdrop": 0.1,
|
| 34 |
"scale_attn_by_inverse_layer_idx": false,
|
|
|
|
| 44 |
"max_length": 50
|
| 45 |
}
|
| 46 |
},
|
| 47 |
+
"transformers_version": "4.57.3",
|
| 48 |
"use_cache": true,
|
| 49 |
+
"vocab_size": 51201
|
| 50 |
}
|
generation_config.json
CHANGED
|
@@ -3,5 +3,5 @@
|
|
| 3 |
"bos_token_id": 0,
|
| 4 |
"eos_token_id": 1,
|
| 5 |
"pad_token_id": 3,
|
| 6 |
-
"transformers_version": "4.57.
|
| 7 |
}
|
|
|
|
| 3 |
"bos_token_id": 0,
|
| 4 |
"eos_token_id": 1,
|
| 5 |
"pad_token_id": 3,
|
| 6 |
+
"transformers_version": "4.57.3"
|
| 7 |
}
|
model.safetensors
CHANGED
|
@@ -1,3 +1,3 @@
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
-
oid sha256:
|
| 3 |
-
size
|
|
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:7325c79dc2a434e6597b2df1e9c258546030f6c8f7a1bad45f372d8c31d2d564
|
| 3 |
+
size 500677436
|
tokenizer_config.json
CHANGED
|
@@ -3014,8 +3014,12 @@
|
|
| 3014 |
"clean_up_tokenization_spaces": false,
|
| 3015 |
"eos_token": "<|endoftext|>",
|
| 3016 |
"extra_special_tokens": {},
|
|
|
|
| 3017 |
"model_max_length": 1000000000000000019884624838656,
|
| 3018 |
"pad_token": "<|endoftext|>",
|
|
|
|
| 3019 |
"tokenizer_class": "GPT2Tokenizer",
|
|
|
|
|
|
|
| 3020 |
"unk_token": "<|endoftext|>"
|
| 3021 |
}
|
|
|
|
| 3014 |
"clean_up_tokenization_spaces": false,
|
| 3015 |
"eos_token": "<|endoftext|>",
|
| 3016 |
"extra_special_tokens": {},
|
| 3017 |
+
"max_length": 512,
|
| 3018 |
"model_max_length": 1000000000000000019884624838656,
|
| 3019 |
"pad_token": "<|endoftext|>",
|
| 3020 |
+
"stride": 0,
|
| 3021 |
"tokenizer_class": "GPT2Tokenizer",
|
| 3022 |
+
"truncation_side": "right",
|
| 3023 |
+
"truncation_strategy": "longest_first",
|
| 3024 |
"unk_token": "<|endoftext|>"
|
| 3025 |
}
|