AZDIN's picture
Upload LLaVA-OneVision weather satellite QLoRA adapter
d04e6d6 verified
Raw
History Blame Contribute Delete
5.59 kB
{
"best_global_step": 124,
"best_metric": 0.19054362177848816,
"best_model_checkpoint": "./llava_qlora_weather_model/checkpoint-124",
"epoch": 3.0,
"eval_steps": 31,
"global_step": 147,
"is_hyper_param_search": false,
"is_local_process_zero": true,
"is_world_process_zero": true,
"log_history": [
{
"epoch": 0.20565552699228792,
"grad_norm": 2.331812620162964,
"learning_rate": 0.0001999744599547812,
"loss": 1.3843,
"mean_token_accuracy": 0.6790310423821211,
"num_tokens": 1290816.0,
"step": 10
},
{
"epoch": 0.41131105398457585,
"grad_norm": 0.9054113030433655,
"learning_rate": 0.00019692540862655585,
"loss": 0.2958,
"mean_token_accuracy": 0.9068963050842285,
"num_tokens": 2581570.0,
"step": 20
},
{
"epoch": 0.6169665809768637,
"grad_norm": 0.7487640380859375,
"learning_rate": 0.00018894622845670283,
"loss": 0.2476,
"mean_token_accuracy": 0.917157232388854,
"num_tokens": 3872000.0,
"step": 30
},
{
"epoch": 0.6375321336760925,
"eval_loss": 0.23227548599243164,
"eval_mean_token_accuracy": 0.9232641770289495,
"eval_num_tokens": 4001060.0,
"eval_runtime": 276.5084,
"eval_samples_per_second": 0.705,
"eval_steps_per_second": 0.705,
"step": 31
},
{
"epoch": 0.8226221079691517,
"grad_norm": 0.6455361843109131,
"learning_rate": 0.0001764427819207624,
"loss": 0.2208,
"mean_token_accuracy": 0.9249804724007845,
"num_tokens": 5162524.0,
"step": 40
},
{
"epoch": 1.0205655526992288,
"grad_norm": 0.5358895659446716,
"learning_rate": 0.00016005105914000507,
"loss": 0.2077,
"mean_token_accuracy": 0.929297363990313,
"num_tokens": 6405024.0,
"step": 50
},
{
"epoch": 1.2262210796915167,
"grad_norm": 0.5378326177597046,
"learning_rate": 0.00014060482812625055,
"loss": 0.1782,
"mean_token_accuracy": 0.9367100398987531,
"num_tokens": 7695653.0,
"step": 60
},
{
"epoch": 1.2673521850899743,
"eval_loss": 0.20991797745227814,
"eval_mean_token_accuracy": 0.9294621323927855,
"eval_num_tokens": 7953894.0,
"eval_runtime": 276.7899,
"eval_samples_per_second": 0.705,
"eval_steps_per_second": 0.705,
"step": 62
},
{
"epoch": 1.4318766066838047,
"grad_norm": 0.5556976199150085,
"learning_rate": 0.00011909322501769406,
"loss": 0.1738,
"mean_token_accuracy": 0.9374068416655064,
"num_tokens": 8986431.0,
"step": 70
},
{
"epoch": 1.6375321336760926,
"grad_norm": 0.5379733443260193,
"learning_rate": 9.661044148624037e-05,
"loss": 0.17,
"mean_token_accuracy": 0.9386381138116121,
"num_tokens": 10277533.0,
"step": 80
},
{
"epoch": 1.8431876606683804,
"grad_norm": 0.532435417175293,
"learning_rate": 7.430006847567972e-05,
"loss": 0.1691,
"mean_token_accuracy": 0.9383826002478599,
"num_tokens": 11568708.0,
"step": 90
},
{
"epoch": 1.904884318766067,
"eval_loss": 0.19236187636852264,
"eval_mean_token_accuracy": 0.934929045347067,
"eval_num_tokens": 11955105.0,
"eval_runtime": 277.3902,
"eval_samples_per_second": 0.703,
"eval_steps_per_second": 0.703,
"step": 93
},
{
"epoch": 2.0411311053984575,
"grad_norm": 0.4640503525733948,
"learning_rate": 5.329692723675994e-05,
"loss": 0.1587,
"mean_token_accuracy": 0.9431061984656693,
"num_tokens": 12809961.0,
"step": 100
},
{
"epoch": 2.2467866323907453,
"grad_norm": 0.4997648596763611,
"learning_rate": 3.466934643431795e-05,
"loss": 0.1347,
"mean_token_accuracy": 0.950631283223629,
"num_tokens": 14099963.0,
"step": 110
},
{
"epoch": 2.4524421593830334,
"grad_norm": 0.44113558530807495,
"learning_rate": 1.9364821412094857e-05,
"loss": 0.131,
"mean_token_accuracy": 0.9509662713855505,
"num_tokens": 15390859.0,
"step": 120
},
{
"epoch": 2.5347043701799485,
"eval_loss": 0.19054362177848816,
"eval_mean_token_accuracy": 0.9369476150243711,
"eval_num_tokens": 15906771.0,
"eval_runtime": 277.9929,
"eval_samples_per_second": 0.701,
"eval_steps_per_second": 0.701,
"step": 124
},
{
"epoch": 2.658097686375321,
"grad_norm": 0.44858983159065247,
"learning_rate": 8.161819666783888e-06,
"loss": 0.1324,
"mean_token_accuracy": 0.9513279229402543,
"num_tokens": 16681649.0,
"step": 130
},
{
"epoch": 2.8637532133676094,
"grad_norm": 0.4972115159034729,
"learning_rate": 1.6301839547892328e-06,
"loss": 0.1297,
"mean_token_accuracy": 0.9516113791614771,
"num_tokens": 17972810.0,
"step": 140
}
],
"logging_steps": 10,
"max_steps": 147,
"num_input_tokens_seen": 0,
"num_train_epochs": 3,
"save_steps": 62,
"stateful_callbacks": {
"TrainerControl": {
"args": {
"should_epoch_stop": false,
"should_evaluate": false,
"should_log": false,
"should_save": true,
"should_training_stop": true
},
"attributes": {}
}
},
"total_flos": 9.168897575363267e+17,
"train_batch_size": 1,
"trial_name": null,
"trial_params": null
}