{ "best_global_step": 1636, "best_metric": 0.623, "best_model_checkpoint": "output/checkpoint-1636", "epoch": 1.0, "eval_steps": 500, "global_step": 1636, "is_hyper_param_search": false, "is_local_process_zero": true, "is_world_process_zero": true, "log_history": [ { "epoch": 0.3056234718826406, "grad_norm": 22.77391815185547, "learning_rate": 4.255239520958084e-05, "loss": 52.1418, "step": 500 }, { "epoch": 0.6112469437652812, "grad_norm": 15.196788787841797, "learning_rate": 2.383982035928144e-05, "loss": 7.7913, "step": 1000 }, { "epoch": 0.9168704156479217, "grad_norm": 13.545781135559082, "learning_rate": 5.127245508982037e-06, "loss": 7.43, "step": 1500 }, { "epoch": 1.0, "eval_loss": 5.054670810699463, "eval_map": 0.623, "eval_map_50": 0.7756, "eval_map_75": 0.6841, "eval_map_barcode": 0.623, "eval_map_large": 0.6594, "eval_map_medium": 0.6674, "eval_map_small": 0.2648, "eval_mar_1": 0.3542, "eval_mar_10": 0.8117, "eval_mar_100": 0.8521, "eval_mar_100_barcode": 0.8521, "eval_mar_large": 0.8749, "eval_mar_medium": 0.8552, "eval_mar_small": 0.5325, "eval_runtime": 71.7672, "eval_samples_per_second": 39.071, "eval_steps_per_second": 4.891, "step": 1636 } ], "logging_steps": 500, "max_steps": 1636, "num_input_tokens_seen": 0, "num_train_epochs": 1, "save_steps": 500, "stateful_callbacks": { "TrainerControl": { "args": { "should_epoch_stop": false, "should_evaluate": false, "should_log": false, "should_save": true, "should_training_stop": true }, "attributes": {} } }, "total_flos": 1.089431706369024e+18, "train_batch_size": 8, "trial_name": null, "trial_params": null }