{ "best_global_step": 3272, "best_metric": 0.6297, "best_model_checkpoint": "output/checkpoint-3272", "epoch": 2.0, "eval_steps": 500, "global_step": 3272, "is_hyper_param_search": false, "is_local_process_zero": true, "is_world_process_zero": true, "log_history": [ { "epoch": 0.3056234718826406, "grad_norm": 22.77391815185547, "learning_rate": 4.255239520958084e-05, "loss": 52.1418, "step": 500 }, { "epoch": 0.6112469437652812, "grad_norm": 15.196788787841797, "learning_rate": 2.383982035928144e-05, "loss": 7.7913, "step": 1000 }, { "epoch": 0.9168704156479217, "grad_norm": 13.545781135559082, "learning_rate": 5.127245508982037e-06, "loss": 7.43, "step": 1500 }, { "epoch": 1.0, "eval_loss": 5.054670810699463, "eval_map": 0.623, "eval_map_50": 0.7756, "eval_map_75": 0.6841, "eval_map_barcode": 0.623, "eval_map_large": 0.6594, "eval_map_medium": 0.6674, "eval_map_small": 0.2648, "eval_mar_1": 0.3542, "eval_mar_10": 0.8117, "eval_mar_100": 0.8521, "eval_mar_100_barcode": 0.8521, "eval_mar_large": 0.8749, "eval_mar_medium": 0.8552, "eval_mar_small": 0.5325, "eval_runtime": 71.7672, "eval_samples_per_second": 39.071, "eval_steps_per_second": 4.891, "step": 1636 }, { "epoch": 1.2224938875305624, "grad_norm": 14.290430068969727, "learning_rate": 3.921954314720812e-05, "loss": 7.2123, "step": 2000 }, { "epoch": 1.528117359413203, "grad_norm": 15.990227699279785, "learning_rate": 3.6046954314720814e-05, "loss": 7.0995, "step": 2500 }, { "epoch": 1.8337408312958434, "grad_norm": 11.737943649291992, "learning_rate": 3.2874365482233505e-05, "loss": 6.9538, "step": 3000 }, { "epoch": 2.0, "eval_loss": 4.950796604156494, "eval_map": 0.6297, "eval_map_50": 0.7829, "eval_map_75": 0.6878, "eval_map_barcode": 0.6297, "eval_map_large": 0.7109, "eval_map_medium": 0.6449, "eval_map_small": 0.261, "eval_mar_1": 0.3612, "eval_mar_10": 0.8238, "eval_mar_100": 0.8604, "eval_mar_100_barcode": 0.8604, "eval_mar_large": 0.8794, "eval_mar_medium": 0.8624, "eval_mar_small": 0.5972, "eval_runtime": 67.4554, "eval_samples_per_second": 41.568, "eval_steps_per_second": 5.203, "step": 3272 } ], "logging_steps": 500, "max_steps": 8180, "num_input_tokens_seen": 0, "num_train_epochs": 5, "save_steps": 500, "stateful_callbacks": { "TrainerControl": { "args": { "should_epoch_stop": false, "should_evaluate": false, "should_log": false, "should_save": true, "should_training_stop": false }, "attributes": {} } }, "total_flos": 2.178863412738048e+18, "train_batch_size": 8, "trial_name": null, "trial_params": null }