wilsonramos commited on
Commit
f12d8f5
·
verified ·
1 Parent(s): b7a0d6d

Upload evaluation files

Browse files
eval/test_metrics.json ADDED
@@ -0,0 +1,7 @@
 
 
 
 
 
 
 
 
1
+ {
2
+ "n_test_samples": 50,
3
+ "prediction_json_valid_rate": 1,
4
+ "target_json_valid_rate": 1,
5
+ "avg_prediction_chars": 6254.58,
6
+ "avg_target_chars": 5991.26
7
+ }
eval/test_metrics_llama31_8b_lora_50samples.json ADDED
@@ -0,0 +1,14 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "model_name": "meta-llama/Llama-3.1-8B-Instruct + LoRA",
3
+ "fine_tuned": true,
4
+ "n_test_samples": 50,
5
+ "batch_size": 8,
6
+ "prediction_json_valid_rate": 1,
7
+ "target_json_valid_rate": 1,
8
+ "prediction_structure_valid_rate": 1,
9
+ "target_structure_valid_rate": 1,
10
+ "avg_prediction_chars": 6254.58,
11
+ "avg_target_chars": 5991.26,
12
+ "avg_input_tokens": 1477.28,
13
+ "avg_generated_tokens": 1855.04
14
+ }
eval/test_predictions_llama31_8b_lora_50samples.jsonl ADDED
The diff for this file is too large to render. See raw diff
 
eval/val_metrics.json ADDED
@@ -0,0 +1,9 @@
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "val_metrics": {
3
+ "eval_loss": 0.8205441832542419,
4
+ "eval_entropy": 0.8040949488541045,
5
+ "eval_num_tokens": 19087305.0,
6
+ "eval_mean_token_accuracy": 0.8164775476037743
7
+ },
8
+ "val_perplexity": 2.2717357417714457
9
+ }