havinash-ai's picture
Training in progress, step 100, checkpoint
fdbb56b verified
Raw History Blame
3.12 kB
{
"best_metric": null,
"best_model_checkpoint": null,
"epoch": 0.175054704595186,
"eval_steps": 50,
"global_step": 100,
"is_hyper_param_search": false,
"is_local_process_zero": true,
"is_world_process_zero": true,
"log_history": [
{
"epoch": 0.00175054704595186,
"eval_loss": 3.942631959915161,
"eval_runtime": 6.5116,
"eval_samples_per_second": 37.011,
"eval_steps_per_second": 18.582,
"step": 1
},
{
"epoch": 0.0175054704595186,
"grad_norm": 4.979578971862793,
"learning_rate": 0.00019967573081342103,
"loss": 2.0182,
"step": 10
},
{
"epoch": 0.0350109409190372,
"grad_norm": 1.4861304759979248,
"learning_rate": 0.0001970941817426052,
"loss": 0.3124,
"step": 20
},
{
"epoch": 0.0525164113785558,
"grad_norm": 3.228330612182617,
"learning_rate": 0.00019199794436588243,
"loss": 0.2282,
"step": 30
},
{
"epoch": 0.0700218818380744,
"grad_norm": 1.115767478942871,
"learning_rate": 0.0001845190085543795,
"loss": 0.1118,
"step": 40
},
{
"epoch": 0.087527352297593,
"grad_norm": 2.745464563369751,
"learning_rate": 0.00017485107481711012,
"loss": 0.1915,
"step": 50
},
{
"epoch": 0.087527352297593,
"eval_loss": 0.15154829621315002,
"eval_runtime": 6.5631,
"eval_samples_per_second": 36.721,
"eval_steps_per_second": 18.437,
"step": 50
},
{
"epoch": 0.1050328227571116,
"grad_norm": 1.6342604160308838,
"learning_rate": 0.00016324453755953773,
"loss": 0.0955,
"step": 60
},
{
"epoch": 0.12253829321663019,
"grad_norm": 1.03786039352417,
"learning_rate": 0.00015000000000000001,
"loss": 0.1122,
"step": 70
},
{
"epoch": 0.1400437636761488,
"grad_norm": 0.6428198218345642,
"learning_rate": 0.00013546048870425356,
"loss": 0.0688,
"step": 80
},
{
"epoch": 0.1575492341356674,
"grad_norm": 0.3404603898525238,
"learning_rate": 0.00012000256937760445,
"loss": 0.1697,
"step": 90
},
{
"epoch": 0.175054704595186,
"grad_norm": 1.3271960020065308,
"learning_rate": 0.00010402659401094152,
"loss": 0.1069,
"step": 100
},
{
"epoch": 0.175054704595186,
"eval_loss": 0.1051642894744873,
"eval_runtime": 6.6187,
"eval_samples_per_second": 36.412,
"eval_steps_per_second": 18.282,
"step": 100
}
],
"logging_steps": 10,
"max_steps": 200,
"num_input_tokens_seen": 0,
"num_train_epochs": 1,
"save_steps": 50,
"stateful_callbacks": {
"TrainerControl": {
"args": {
"should_epoch_stop": false,
"should_evaluate": false,
"should_log": false,
"should_save": true,
"should_training_stop": false
},
"attributes": {}
}
},
"total_flos": 5000973307084800.0,
"train_batch_size": 2,
"trial_name": null,
"trial_params": null
}