KB8407 commited on
Commit
6c88c8d
·
verified ·
1 Parent(s): 5fb9bce

Update PPO model

Browse files
README.md CHANGED
@@ -25,7 +25,7 @@ You can then generate text as follows:
25
  ```python
26
  from transformers import pipeline
27
 
28
- generator = pipeline("text-generation", model="KB8407//content/drive/MyDrive/R&E 2B (Good)/outputs/ppo/final")
29
  outputs = generator("Hello, my llama is cute")
30
  ```
31
 
@@ -35,8 +35,8 @@ If you want to use the model for training or to obtain the outputs from the valu
35
  from transformers import AutoTokenizer
36
  from trl import AutoModelForCausalLMWithValueHead
37
 
38
- tokenizer = AutoTokenizer.from_pretrained("KB8407//content/drive/MyDrive/R&E 2B (Good)/outputs/ppo/final")
39
- model = AutoModelForCausalLMWithValueHead.from_pretrained("KB8407//content/drive/MyDrive/R&E 2B (Good)/outputs/ppo/final")
40
 
41
  inputs = tokenizer("Hello, my llama is cute", return_tensors="pt")
42
  outputs = model(**inputs, labels=inputs["input_ids"])
 
25
  ```python
26
  from transformers import pipeline
27
 
28
+ generator = pipeline("text-generation", model="KB8407/outputs/ppo/final")
29
  outputs = generator("Hello, my llama is cute")
30
  ```
31
 
 
35
  from transformers import AutoTokenizer
36
  from trl import AutoModelForCausalLMWithValueHead
37
 
38
+ tokenizer = AutoTokenizer.from_pretrained("KB8407/outputs/ppo/final")
39
+ model = AutoModelForCausalLMWithValueHead.from_pretrained("KB8407/outputs/ppo/final")
40
 
41
  inputs = tokenizer("Hello, my llama is cute", return_tensors="pt")
42
  outputs = model(**inputs, labels=inputs["input_ids"])
config.json CHANGED
@@ -8,9 +8,9 @@
8
  "author": "Heewon Jeon(madjakarta@gmail.com)",
9
  "bos_token_id": 0,
10
  "created_date": "2021-04-28",
11
- "dtype": "bfloat16",
12
  "embd_pdrop": 0.1,
13
- "eos_token_id": 1,
14
  "gradient_checkpointing": false,
15
  "id2label": {
16
  "0": "LABEL_0"
@@ -28,7 +28,7 @@
28
  "n_inner": null,
29
  "n_layer": 12,
30
  "n_positions": 1024,
31
- "pad_token_id": 3,
32
  "reorder_and_upcast_attn": false,
33
  "resid_pdrop": 0.1,
34
  "scale_attn_by_inverse_layer_idx": false,
@@ -44,7 +44,7 @@
44
  "max_length": 50
45
  }
46
  },
47
- "transformers_version": "4.57.2",
48
  "use_cache": true,
49
- "vocab_size": 51200
50
  }
 
8
  "author": "Heewon Jeon(madjakarta@gmail.com)",
9
  "bos_token_id": 0,
10
  "created_date": "2021-04-28",
11
+ "dtype": "float32",
12
  "embd_pdrop": 0.1,
13
+ "eos_token_id": 51200,
14
  "gradient_checkpointing": false,
15
  "id2label": {
16
  "0": "LABEL_0"
 
28
  "n_inner": null,
29
  "n_layer": 12,
30
  "n_positions": 1024,
31
+ "pad_token_id": 51200,
32
  "reorder_and_upcast_attn": false,
33
  "resid_pdrop": 0.1,
34
  "scale_attn_by_inverse_layer_idx": false,
 
44
  "max_length": 50
45
  }
46
  },
47
+ "transformers_version": "4.57.3",
48
  "use_cache": true,
49
+ "vocab_size": 51201
50
  }
generation_config.json CHANGED
@@ -3,5 +3,5 @@
3
  "bos_token_id": 0,
4
  "eos_token_id": 1,
5
  "pad_token_id": 3,
6
- "transformers_version": "4.57.2"
7
  }
 
3
  "bos_token_id": 0,
4
  "eos_token_id": 1,
5
  "pad_token_id": 3,
6
+ "transformers_version": "4.57.3"
7
  }
model.safetensors CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:7a584adb5bf54418da76a7feabe963a70d1cb7fb1ede012061c8aef95e6de738
3
- size 250346332
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:7325c79dc2a434e6597b2df1e9c258546030f6c8f7a1bad45f372d8c31d2d564
3
+ size 500677436
tokenizer_config.json CHANGED
@@ -3014,8 +3014,12 @@
3014
  "clean_up_tokenization_spaces": false,
3015
  "eos_token": "<|endoftext|>",
3016
  "extra_special_tokens": {},
 
3017
  "model_max_length": 1000000000000000019884624838656,
3018
  "pad_token": "<|endoftext|>",
 
3019
  "tokenizer_class": "GPT2Tokenizer",
 
 
3020
  "unk_token": "<|endoftext|>"
3021
  }
 
3014
  "clean_up_tokenization_spaces": false,
3015
  "eos_token": "<|endoftext|>",
3016
  "extra_special_tokens": {},
3017
+ "max_length": 512,
3018
  "model_max_length": 1000000000000000019884624838656,
3019
  "pad_token": "<|endoftext|>",
3020
+ "stride": 0,
3021
  "tokenizer_class": "GPT2Tokenizer",
3022
+ "truncation_side": "right",
3023
+ "truncation_strategy": "longest_first",
3024
  "unk_token": "<|endoftext|>"
3025
  }