ygaci commited on
Commit
d64ea7d
·
verified ·
1 Parent(s): 2426546

Training in progress, epoch 4, checkpoint

Browse files
last-checkpoint/adapter_model.safetensors CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:ca016f972ff2ad4f3bf690d810f748cd5d17582390326ca08c105b8f17981d63
3
  size 146815928
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:ff18b78e9495eae88b2aab80580e8790c2ea74fcf4f7e6484bbe2c870e56a8b7
3
  size 146815928
last-checkpoint/optimizer.pt CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:f8c1e0c5fb7fec933dc4f450340813b9173fd47c38dc7bd03b8fd54ae634afbe
3
  size 74680890
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:3cf32c52d73832147adfeeee41ff7c6ea6e0dc6cc369b204ac04c55f6a3a72e3
3
  size 74680890
last-checkpoint/rng_state.pth CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:b2b74f6db6173db8ce9081542b2c273335304d77891e1c11d131f4f4b5df6066
3
  size 14244
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:99a75ce073a6c74625ca2933c59efc2bbdec73e4dcc9c0f42c6635108770fd0e
3
  size 14244
last-checkpoint/scheduler.pt CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:2c3ee03ba61886e9f659b6b5747d35d37da569234d10d7c1f12931685c580c5c
3
  size 1064
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:4c993e8ee8af283924df8f63ed21f3efad8f3c9d9bc2b9b16c0d84b0dff0ef93
3
  size 1064
last-checkpoint/trainer_state.json CHANGED
@@ -1,9 +1,9 @@
1
  {
2
  "best_metric": null,
3
  "best_model_checkpoint": null,
4
- "epoch": 3.0,
5
  "eval_steps": 500,
6
- "global_step": 1050,
7
  "is_hyper_param_search": false,
8
  "is_local_process_zero": true,
9
  "is_world_process_zero": true,
@@ -101,6 +101,42 @@
101
  "eval_samples_per_second": 2.11,
102
  "eval_steps_per_second": 0.527,
103
  "step": 1050
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
104
  }
105
  ],
106
  "logging_steps": 100,
@@ -120,7 +156,7 @@
120
  "attributes": {}
121
  }
122
  },
123
- "total_flos": 2.569868529159373e+16,
124
  "train_batch_size": 4,
125
  "trial_name": null,
126
  "trial_params": null
 
1
  {
2
  "best_metric": null,
3
  "best_model_checkpoint": null,
4
+ "epoch": 4.0,
5
  "eval_steps": 500,
6
+ "global_step": 1400,
7
  "is_hyper_param_search": false,
8
  "is_local_process_zero": true,
9
  "is_world_process_zero": true,
 
101
  "eval_samples_per_second": 2.11,
102
  "eval_steps_per_second": 0.527,
103
  "step": 1050
104
+ },
105
+ {
106
+ "epoch": 3.142857142857143,
107
+ "grad_norm": 0.3725013732910156,
108
+ "learning_rate": 0.00016,
109
+ "loss": 0.2173,
110
+ "step": 1100
111
+ },
112
+ {
113
+ "epoch": 3.4285714285714284,
114
+ "grad_norm": 0.3499898612499237,
115
+ "learning_rate": 0.00015333333333333334,
116
+ "loss": 0.216,
117
+ "step": 1200
118
+ },
119
+ {
120
+ "epoch": 3.7142857142857144,
121
+ "grad_norm": 0.369825541973114,
122
+ "learning_rate": 0.00014666666666666666,
123
+ "loss": 0.2049,
124
+ "step": 1300
125
+ },
126
+ {
127
+ "epoch": 4.0,
128
+ "grad_norm": 0.28506389260292053,
129
+ "learning_rate": 0.00014,
130
+ "loss": 0.2089,
131
+ "step": 1400
132
+ },
133
+ {
134
+ "epoch": 4.0,
135
+ "eval_loss": 0.24056243896484375,
136
+ "eval_runtime": 331.7171,
137
+ "eval_samples_per_second": 2.11,
138
+ "eval_steps_per_second": 0.528,
139
+ "step": 1400
140
  }
141
  ],
142
  "logging_steps": 100,
 
156
  "attributes": {}
157
  }
158
  },
159
+ "total_flos": 3.435572847915827e+16,
160
  "train_batch_size": 4,
161
  "trial_name": null,
162
  "trial_params": null