lcampillos's picture
Added files
f81d36a
Raw History Blame
8.28 kB
{
"best_metric": 0.8770697441043652,
"best_model_checkpoint": "xlm-roberta-large-spanish-clinical-medic-attr-ner-cima-cases-early-stop-round5/checkpoint-21714",
"epoch": 7.0,
"global_step": 21714,
"is_hyper_param_search": false,
"is_local_process_zero": true,
"is_world_process_zero": true,
"log_history": [
{
"epoch": 0.16,
"learning_rate": 1.989254244573394e-05,
"loss": 0.1565,
"step": 500
},
{
"epoch": 0.32,
"learning_rate": 1.9785084891467873e-05,
"loss": 0.0586,
"step": 1000
},
{
"epoch": 0.48,
"learning_rate": 1.9677627337201807e-05,
"loss": 0.0462,
"step": 1500
},
{
"epoch": 0.64,
"learning_rate": 1.957016978293574e-05,
"loss": 0.0375,
"step": 2000
},
{
"epoch": 0.81,
"learning_rate": 1.946271222866968e-05,
"loss": 0.0346,
"step": 2500
},
{
"epoch": 0.97,
"learning_rate": 1.9355254674403613e-05,
"loss": 0.0349,
"step": 3000
},
{
"epoch": 1.0,
"eval_accuracy": 0.9956815585119774,
"eval_f1": 0.8532249873031995,
"eval_loss": 0.0175024326890707,
"eval_precision": 0.8759124087591241,
"eval_recall": 0.8316831683168316,
"eval_runtime": 11.689,
"eval_samples_per_second": 353.838,
"eval_steps_per_second": 44.23,
"step": 3102
},
{
"epoch": 1.13,
"learning_rate": 1.9247797120137547e-05,
"loss": 0.0317,
"step": 3500
},
{
"epoch": 1.29,
"learning_rate": 1.914033956587148e-05,
"loss": 0.0207,
"step": 4000
},
{
"epoch": 1.45,
"learning_rate": 1.9032882011605418e-05,
"loss": 0.0274,
"step": 4500
},
{
"epoch": 1.61,
"learning_rate": 1.8925424457339352e-05,
"loss": 0.0205,
"step": 5000
},
{
"epoch": 1.77,
"learning_rate": 1.881796690307329e-05,
"loss": 0.0254,
"step": 5500
},
{
"epoch": 1.93,
"learning_rate": 1.8710509348807224e-05,
"loss": 0.0187,
"step": 6000
},
{
"epoch": 2.0,
"eval_accuracy": 0.9956718759077442,
"eval_f1": 0.832442933462846,
"eval_loss": 0.016502007842063904,
"eval_precision": 0.8169685414680649,
"eval_recall": 0.8485148514851485,
"eval_runtime": 11.4567,
"eval_samples_per_second": 361.013,
"eval_steps_per_second": 45.127,
"step": 6204
},
{
"epoch": 2.1,
"learning_rate": 1.8603051794541158e-05,
"loss": 0.0183,
"step": 6500
},
{
"epoch": 2.26,
"learning_rate": 1.849559424027509e-05,
"loss": 0.0126,
"step": 7000
},
{
"epoch": 2.42,
"learning_rate": 1.838813668600903e-05,
"loss": 0.0194,
"step": 7500
},
{
"epoch": 2.58,
"learning_rate": 1.8280679131742963e-05,
"loss": 0.0203,
"step": 8000
},
{
"epoch": 2.74,
"learning_rate": 1.8173221577476897e-05,
"loss": 0.018,
"step": 8500
},
{
"epoch": 2.9,
"learning_rate": 1.806576402321083e-05,
"loss": 0.0206,
"step": 9000
},
{
"epoch": 3.0,
"eval_accuracy": 0.9954782238230795,
"eval_f1": 0.8585858585858587,
"eval_loss": 0.02153652347624302,
"eval_precision": 0.8762886597938144,
"eval_recall": 0.8415841584158416,
"eval_runtime": 11.4248,
"eval_samples_per_second": 362.02,
"eval_steps_per_second": 45.252,
"step": 9306
},
{
"epoch": 3.06,
"learning_rate": 1.795830646894477e-05,
"loss": 0.0144,
"step": 9500
},
{
"epoch": 3.22,
"learning_rate": 1.7850848914678703e-05,
"loss": 0.0142,
"step": 10000
},
{
"epoch": 3.38,
"learning_rate": 1.774339136041264e-05,
"loss": 0.0114,
"step": 10500
},
{
"epoch": 3.55,
"learning_rate": 1.7635933806146574e-05,
"loss": 0.0155,
"step": 11000
},
{
"epoch": 3.71,
"learning_rate": 1.7528476251880508e-05,
"loss": 0.0128,
"step": 11500
},
{
"epoch": 3.87,
"learning_rate": 1.7421018697614445e-05,
"loss": 0.0144,
"step": 12000
},
{
"epoch": 4.0,
"eval_accuracy": 0.9957783845543098,
"eval_f1": 0.86,
"eval_loss": 0.021290840581059456,
"eval_precision": 0.8686868686868687,
"eval_recall": 0.8514851485148515,
"eval_runtime": 11.4556,
"eval_samples_per_second": 361.046,
"eval_steps_per_second": 45.131,
"step": 12408
},
{
"epoch": 4.03,
"learning_rate": 1.731356114334838e-05,
"loss": 0.0159,
"step": 12500
},
{
"epoch": 4.19,
"learning_rate": 1.7206103589082313e-05,
"loss": 0.0091,
"step": 13000
},
{
"epoch": 4.35,
"learning_rate": 1.7098646034816248e-05,
"loss": 0.0105,
"step": 13500
},
{
"epoch": 4.51,
"learning_rate": 1.6991188480550185e-05,
"loss": 0.0109,
"step": 14000
},
{
"epoch": 4.67,
"learning_rate": 1.688373092628412e-05,
"loss": 0.011,
"step": 14500
},
{
"epoch": 4.84,
"learning_rate": 1.6776273372018056e-05,
"loss": 0.0154,
"step": 15000
},
{
"epoch": 5.0,
"learning_rate": 1.666881581775199e-05,
"loss": 0.0136,
"step": 15500
},
{
"epoch": 5.0,
"eval_accuracy": 0.9955750498654118,
"eval_f1": 0.8574190430159497,
"eval_loss": 0.023742612451314926,
"eval_precision": 0.8375826251180358,
"eval_recall": 0.8782178217821782,
"eval_runtime": 11.5216,
"eval_samples_per_second": 358.978,
"eval_steps_per_second": 44.872,
"step": 15510
},
{
"epoch": 5.16,
"learning_rate": 1.6561358263485924e-05,
"loss": 0.0078,
"step": 16000
},
{
"epoch": 5.32,
"learning_rate": 1.645390070921986e-05,
"loss": 0.0086,
"step": 16500
},
{
"epoch": 5.48,
"learning_rate": 1.6346443154953796e-05,
"loss": 0.0088,
"step": 17000
},
{
"epoch": 5.64,
"learning_rate": 1.623898560068773e-05,
"loss": 0.0124,
"step": 17500
},
{
"epoch": 5.8,
"learning_rate": 1.6131528046421664e-05,
"loss": 0.0097,
"step": 18000
},
{
"epoch": 5.96,
"learning_rate": 1.6024070492155598e-05,
"loss": 0.0062,
"step": 18500
},
{
"epoch": 6.0,
"eval_accuracy": 0.995255523925715,
"eval_f1": 0.847248576850095,
"eval_loss": 0.02595967799425125,
"eval_precision": 0.8132969034608379,
"eval_recall": 0.8841584158415842,
"eval_runtime": 11.399,
"eval_samples_per_second": 362.839,
"eval_steps_per_second": 45.355,
"step": 18612
},
{
"epoch": 6.13,
"learning_rate": 1.5916612937889535e-05,
"loss": 0.008,
"step": 19000
},
{
"epoch": 6.29,
"learning_rate": 1.580915538362347e-05,
"loss": 0.0108,
"step": 19500
},
{
"epoch": 6.45,
"learning_rate": 1.5701697829357407e-05,
"loss": 0.0065,
"step": 20000
},
{
"epoch": 6.61,
"learning_rate": 1.559424027509134e-05,
"loss": 0.0076,
"step": 20500
},
{
"epoch": 6.77,
"learning_rate": 1.5486782720825275e-05,
"loss": 0.0108,
"step": 21000
},
{
"epoch": 6.93,
"learning_rate": 1.5379325166559212e-05,
"loss": 0.0117,
"step": 21500
},
{
"epoch": 7.0,
"eval_accuracy": 0.9962721973702047,
"eval_f1": 0.8770697441043652,
"eval_loss": 0.025852469727396965,
"eval_precision": 0.8891149542217701,
"eval_recall": 0.8653465346534653,
"eval_runtime": 11.3646,
"eval_samples_per_second": 363.939,
"eval_steps_per_second": 45.492,
"step": 21714
}
],
"max_steps": 93060,
"num_train_epochs": 30,
"total_flos": 1.869620608557659e+16,
"trial_name": null,
"trial_params": null
}