| { |
| "best_global_step": 124, |
| "best_metric": 0.19054362177848816, |
| "best_model_checkpoint": "./llava_qlora_weather_model/checkpoint-124", |
| "epoch": 3.0, |
| "eval_steps": 31, |
| "global_step": 147, |
| "is_hyper_param_search": false, |
| "is_local_process_zero": true, |
| "is_world_process_zero": true, |
| "log_history": [ |
| { |
| "epoch": 0.20565552699228792, |
| "grad_norm": 2.331812620162964, |
| "learning_rate": 0.0001999744599547812, |
| "loss": 1.3843, |
| "mean_token_accuracy": 0.6790310423821211, |
| "num_tokens": 1290816.0, |
| "step": 10 |
| }, |
| { |
| "epoch": 0.41131105398457585, |
| "grad_norm": 0.9054113030433655, |
| "learning_rate": 0.00019692540862655585, |
| "loss": 0.2958, |
| "mean_token_accuracy": 0.9068963050842285, |
| "num_tokens": 2581570.0, |
| "step": 20 |
| }, |
| { |
| "epoch": 0.6169665809768637, |
| "grad_norm": 0.7487640380859375, |
| "learning_rate": 0.00018894622845670283, |
| "loss": 0.2476, |
| "mean_token_accuracy": 0.917157232388854, |
| "num_tokens": 3872000.0, |
| "step": 30 |
| }, |
| { |
| "epoch": 0.6375321336760925, |
| "eval_loss": 0.23227548599243164, |
| "eval_mean_token_accuracy": 0.9232641770289495, |
| "eval_num_tokens": 4001060.0, |
| "eval_runtime": 276.5084, |
| "eval_samples_per_second": 0.705, |
| "eval_steps_per_second": 0.705, |
| "step": 31 |
| }, |
| { |
| "epoch": 0.8226221079691517, |
| "grad_norm": 0.6455361843109131, |
| "learning_rate": 0.0001764427819207624, |
| "loss": 0.2208, |
| "mean_token_accuracy": 0.9249804724007845, |
| "num_tokens": 5162524.0, |
| "step": 40 |
| }, |
| { |
| "epoch": 1.0205655526992288, |
| "grad_norm": 0.5358895659446716, |
| "learning_rate": 0.00016005105914000507, |
| "loss": 0.2077, |
| "mean_token_accuracy": 0.929297363990313, |
| "num_tokens": 6405024.0, |
| "step": 50 |
| }, |
| { |
| "epoch": 1.2262210796915167, |
| "grad_norm": 0.5378326177597046, |
| "learning_rate": 0.00014060482812625055, |
| "loss": 0.1782, |
| "mean_token_accuracy": 0.9367100398987531, |
| "num_tokens": 7695653.0, |
| "step": 60 |
| }, |
| { |
| "epoch": 1.2673521850899743, |
| "eval_loss": 0.20991797745227814, |
| "eval_mean_token_accuracy": 0.9294621323927855, |
| "eval_num_tokens": 7953894.0, |
| "eval_runtime": 276.7899, |
| "eval_samples_per_second": 0.705, |
| "eval_steps_per_second": 0.705, |
| "step": 62 |
| }, |
| { |
| "epoch": 1.4318766066838047, |
| "grad_norm": 0.5556976199150085, |
| "learning_rate": 0.00011909322501769406, |
| "loss": 0.1738, |
| "mean_token_accuracy": 0.9374068416655064, |
| "num_tokens": 8986431.0, |
| "step": 70 |
| }, |
| { |
| "epoch": 1.6375321336760926, |
| "grad_norm": 0.5379733443260193, |
| "learning_rate": 9.661044148624037e-05, |
| "loss": 0.17, |
| "mean_token_accuracy": 0.9386381138116121, |
| "num_tokens": 10277533.0, |
| "step": 80 |
| }, |
| { |
| "epoch": 1.8431876606683804, |
| "grad_norm": 0.532435417175293, |
| "learning_rate": 7.430006847567972e-05, |
| "loss": 0.1691, |
| "mean_token_accuracy": 0.9383826002478599, |
| "num_tokens": 11568708.0, |
| "step": 90 |
| }, |
| { |
| "epoch": 1.904884318766067, |
| "eval_loss": 0.19236187636852264, |
| "eval_mean_token_accuracy": 0.934929045347067, |
| "eval_num_tokens": 11955105.0, |
| "eval_runtime": 277.3902, |
| "eval_samples_per_second": 0.703, |
| "eval_steps_per_second": 0.703, |
| "step": 93 |
| }, |
| { |
| "epoch": 2.0411311053984575, |
| "grad_norm": 0.4640503525733948, |
| "learning_rate": 5.329692723675994e-05, |
| "loss": 0.1587, |
| "mean_token_accuracy": 0.9431061984656693, |
| "num_tokens": 12809961.0, |
| "step": 100 |
| }, |
| { |
| "epoch": 2.2467866323907453, |
| "grad_norm": 0.4997648596763611, |
| "learning_rate": 3.466934643431795e-05, |
| "loss": 0.1347, |
| "mean_token_accuracy": 0.950631283223629, |
| "num_tokens": 14099963.0, |
| "step": 110 |
| }, |
| { |
| "epoch": 2.4524421593830334, |
| "grad_norm": 0.44113558530807495, |
| "learning_rate": 1.9364821412094857e-05, |
| "loss": 0.131, |
| "mean_token_accuracy": 0.9509662713855505, |
| "num_tokens": 15390859.0, |
| "step": 120 |
| }, |
| { |
| "epoch": 2.5347043701799485, |
| "eval_loss": 0.19054362177848816, |
| "eval_mean_token_accuracy": 0.9369476150243711, |
| "eval_num_tokens": 15906771.0, |
| "eval_runtime": 277.9929, |
| "eval_samples_per_second": 0.701, |
| "eval_steps_per_second": 0.701, |
| "step": 124 |
| }, |
| { |
| "epoch": 2.658097686375321, |
| "grad_norm": 0.44858983159065247, |
| "learning_rate": 8.161819666783888e-06, |
| "loss": 0.1324, |
| "mean_token_accuracy": 0.9513279229402543, |
| "num_tokens": 16681649.0, |
| "step": 130 |
| }, |
| { |
| "epoch": 2.8637532133676094, |
| "grad_norm": 0.4972115159034729, |
| "learning_rate": 1.6301839547892328e-06, |
| "loss": 0.1297, |
| "mean_token_accuracy": 0.9516113791614771, |
| "num_tokens": 17972810.0, |
| "step": 140 |
| } |
| ], |
| "logging_steps": 10, |
| "max_steps": 147, |
| "num_input_tokens_seen": 0, |
| "num_train_epochs": 3, |
| "save_steps": 62, |
| "stateful_callbacks": { |
| "TrainerControl": { |
| "args": { |
| "should_epoch_stop": false, |
| "should_evaluate": false, |
| "should_log": false, |
| "should_save": true, |
| "should_training_stop": true |
| }, |
| "attributes": {} |
| } |
| }, |
| "total_flos": 9.168897575363267e+17, |
| "train_batch_size": 1, |
| "trial_name": null, |
| "trial_params": null |
| } |
|
|