benjamintli's picture
Training in progress, epoch 2, checkpoint
ee25eb5 verified
Raw
History Blame
3.11 kB
{
"best_global_step": 3272,
"best_metric": 0.6297,
"best_model_checkpoint": "output/checkpoint-3272",
"epoch": 2.0,
"eval_steps": 500,
"global_step": 3272,
"is_hyper_param_search": false,
"is_local_process_zero": true,
"is_world_process_zero": true,
"log_history": [
{
"epoch": 0.3056234718826406,
"grad_norm": 22.77391815185547,
"learning_rate": 4.255239520958084e-05,
"loss": 52.1418,
"step": 500
},
{
"epoch": 0.6112469437652812,
"grad_norm": 15.196788787841797,
"learning_rate": 2.383982035928144e-05,
"loss": 7.7913,
"step": 1000
},
{
"epoch": 0.9168704156479217,
"grad_norm": 13.545781135559082,
"learning_rate": 5.127245508982037e-06,
"loss": 7.43,
"step": 1500
},
{
"epoch": 1.0,
"eval_loss": 5.054670810699463,
"eval_map": 0.623,
"eval_map_50": 0.7756,
"eval_map_75": 0.6841,
"eval_map_barcode": 0.623,
"eval_map_large": 0.6594,
"eval_map_medium": 0.6674,
"eval_map_small": 0.2648,
"eval_mar_1": 0.3542,
"eval_mar_10": 0.8117,
"eval_mar_100": 0.8521,
"eval_mar_100_barcode": 0.8521,
"eval_mar_large": 0.8749,
"eval_mar_medium": 0.8552,
"eval_mar_small": 0.5325,
"eval_runtime": 71.7672,
"eval_samples_per_second": 39.071,
"eval_steps_per_second": 4.891,
"step": 1636
},
{
"epoch": 1.2224938875305624,
"grad_norm": 14.290430068969727,
"learning_rate": 3.921954314720812e-05,
"loss": 7.2123,
"step": 2000
},
{
"epoch": 1.528117359413203,
"grad_norm": 15.990227699279785,
"learning_rate": 3.6046954314720814e-05,
"loss": 7.0995,
"step": 2500
},
{
"epoch": 1.8337408312958434,
"grad_norm": 11.737943649291992,
"learning_rate": 3.2874365482233505e-05,
"loss": 6.9538,
"step": 3000
},
{
"epoch": 2.0,
"eval_loss": 4.950796604156494,
"eval_map": 0.6297,
"eval_map_50": 0.7829,
"eval_map_75": 0.6878,
"eval_map_barcode": 0.6297,
"eval_map_large": 0.7109,
"eval_map_medium": 0.6449,
"eval_map_small": 0.261,
"eval_mar_1": 0.3612,
"eval_mar_10": 0.8238,
"eval_mar_100": 0.8604,
"eval_mar_100_barcode": 0.8604,
"eval_mar_large": 0.8794,
"eval_mar_medium": 0.8624,
"eval_mar_small": 0.5972,
"eval_runtime": 67.4554,
"eval_samples_per_second": 41.568,
"eval_steps_per_second": 5.203,
"step": 3272
}
],
"logging_steps": 500,
"max_steps": 8180,
"num_input_tokens_seen": 0,
"num_train_epochs": 5,
"save_steps": 500,
"stateful_callbacks": {
"TrainerControl": {
"args": {
"should_epoch_stop": false,
"should_evaluate": false,
"should_log": false,
"should_save": true,
"should_training_stop": false
},
"attributes": {}
}
},
"total_flos": 2.178863412738048e+18,
"train_batch_size": 8,
"trial_name": null,
"trial_params": null
}