keisuke-miyako commited on
Commit
1891c88
·
verified ·
1 Parent(s): fa949d5

r3 upload — LoRA adapter

Browse files
.gitattributes CHANGED
@@ -33,3 +33,5 @@ saved_model/**/* filter=lfs diff=lfs merge=lfs -text
33
  *.zip filter=lfs diff=lfs merge=lfs -text
34
  *.zst filter=lfs diff=lfs merge=lfs -text
35
  *tfevents* filter=lfs diff=lfs merge=lfs -text
 
 
 
33
  *.zip filter=lfs diff=lfs merge=lfs -text
34
  *.zst filter=lfs diff=lfs merge=lfs -text
35
  *tfevents* filter=lfs diff=lfs merge=lfs -text
36
+ tokenizer.json filter=lfs diff=lfs merge=lfs -text
37
+ training-loss.png filter=lfs diff=lfs merge=lfs -text
README.md ADDED
@@ -0,0 +1,20 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ ---
2
+ base_model: BAAI/bge-m3
3
+ tags:
4
+ - doc
5
+ - embeddings
6
+ - peft
7
+ - lora
8
+ ---
9
+ # bge-m3-doc-r3 LoRA adapter
10
+
11
+ LoRA adapter (r=16) fine-tuned on 4D doc document embeddings.
12
+ Dataset: [keisuke-miyako/doc-2026-0610](https://huggingface.co/datasets/keisuke-miyako/doc-2026-0610)
13
+
14
+ ## Load
15
+ ```python
16
+ from peft import PeftModel
17
+ from transformers import AutoModel
18
+ base = AutoModel.from_pretrained("BAAI/bge-m3")
19
+ model = PeftModel.from_pretrained(base, "keisuke-miyako/bge-m3-doc-r3-adapter")
20
+ ```
adapter_config.json ADDED
@@ -0,0 +1,34 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "alpha_pattern": {},
3
+ "auto_mapping": null,
4
+ "base_model_name_or_path": "keisuke-miyako/bge-m3-doc-R1-merged",
5
+ "bias": "none",
6
+ "eva_config": null,
7
+ "exclude_modules": null,
8
+ "fan_in_fan_out": false,
9
+ "inference_mode": true,
10
+ "init_lora_weights": true,
11
+ "layer_replication": null,
12
+ "layers_pattern": null,
13
+ "layers_to_transform": null,
14
+ "loftq_config": {},
15
+ "lora_alpha": 32,
16
+ "lora_bias": false,
17
+ "lora_dropout": 0.1,
18
+ "megatron_config": null,
19
+ "megatron_core": "megatron.core",
20
+ "modules_to_save": null,
21
+ "peft_type": "LORA",
22
+ "r": 16,
23
+ "rank_pattern": {},
24
+ "revision": null,
25
+ "target_modules": [
26
+ "dense",
27
+ "query",
28
+ "key",
29
+ "value"
30
+ ],
31
+ "task_type": "FEATURE_EXTRACTION",
32
+ "use_dora": false,
33
+ "use_rslora": false
34
+ }
adapter_model.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:c77589270adf6adf4fed646b659543de5c6e30bd961da7ec5afc759f5ea8e667
3
+ size 28482384
sentencepiece.bpe.model ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:cfc8146abe2a0488e9e2a0c56de7952f7c11ab059eca145a0a727afce0db2865
3
+ size 5069051
special_tokens_map.json ADDED
@@ -0,0 +1,51 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "bos_token": {
3
+ "content": "<s>",
4
+ "lstrip": false,
5
+ "normalized": false,
6
+ "rstrip": false,
7
+ "single_word": false
8
+ },
9
+ "cls_token": {
10
+ "content": "<s>",
11
+ "lstrip": false,
12
+ "normalized": false,
13
+ "rstrip": false,
14
+ "single_word": false
15
+ },
16
+ "eos_token": {
17
+ "content": "</s>",
18
+ "lstrip": false,
19
+ "normalized": false,
20
+ "rstrip": false,
21
+ "single_word": false
22
+ },
23
+ "mask_token": {
24
+ "content": "<mask>",
25
+ "lstrip": true,
26
+ "normalized": false,
27
+ "rstrip": false,
28
+ "single_word": false
29
+ },
30
+ "pad_token": {
31
+ "content": "<pad>",
32
+ "lstrip": false,
33
+ "normalized": false,
34
+ "rstrip": false,
35
+ "single_word": false
36
+ },
37
+ "sep_token": {
38
+ "content": "</s>",
39
+ "lstrip": false,
40
+ "normalized": false,
41
+ "rstrip": false,
42
+ "single_word": false
43
+ },
44
+ "unk_token": {
45
+ "content": "<unk>",
46
+ "lstrip": false,
47
+ "normalized": false,
48
+ "rstrip": false,
49
+ "single_word": false
50
+ }
51
+ }
tokenizer.json ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:e4f7e21bec3fb0044ca0bb2d50eb5d4d8c596273c422baef84466d2c73748b9c
3
+ size 17083053
tokenizer_config.json ADDED
@@ -0,0 +1,55 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "added_tokens_decoder": {
3
+ "0": {
4
+ "content": "<s>",
5
+ "lstrip": false,
6
+ "normalized": false,
7
+ "rstrip": false,
8
+ "single_word": false,
9
+ "special": true
10
+ },
11
+ "1": {
12
+ "content": "<pad>",
13
+ "lstrip": false,
14
+ "normalized": false,
15
+ "rstrip": false,
16
+ "single_word": false,
17
+ "special": true
18
+ },
19
+ "2": {
20
+ "content": "</s>",
21
+ "lstrip": false,
22
+ "normalized": false,
23
+ "rstrip": false,
24
+ "single_word": false,
25
+ "special": true
26
+ },
27
+ "3": {
28
+ "content": "<unk>",
29
+ "lstrip": false,
30
+ "normalized": false,
31
+ "rstrip": false,
32
+ "single_word": false,
33
+ "special": true
34
+ },
35
+ "250001": {
36
+ "content": "<mask>",
37
+ "lstrip": true,
38
+ "normalized": false,
39
+ "rstrip": false,
40
+ "single_word": false,
41
+ "special": true
42
+ }
43
+ },
44
+ "bos_token": "<s>",
45
+ "clean_up_tokenization_spaces": true,
46
+ "cls_token": "<s>",
47
+ "eos_token": "</s>",
48
+ "mask_token": "<mask>",
49
+ "model_max_length": 8192,
50
+ "pad_token": "<pad>",
51
+ "sep_token": "</s>",
52
+ "sp_model_kwargs": {},
53
+ "tokenizer_class": "XLMRobertaTokenizer",
54
+ "unk_token": "<unk>"
55
+ }
training-loss.csv ADDED
@@ -0,0 +1,137 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ step,loss
2
+ 10,0.3803
3
+ 20,0.3879
4
+ 30,0.3735
5
+ 40,0.4032
6
+ 50,0.3795
7
+ 60,0.382
8
+ 70,0.3946
9
+ 80,0.393
10
+ 90,0.3689
11
+ 100,0.3891
12
+ 110,0.3925
13
+ 120,0.3933
14
+ 130,0.3769
15
+ 140,0.3848
16
+ 150,0.3552
17
+ 160,0.3535
18
+ 170,0.3597
19
+ 180,0.3304
20
+ 190,0.3692
21
+ 200,0.331
22
+ 210,0.318
23
+ 220,0.3302
24
+ 230,0.3309
25
+ 240,0.3181
26
+ 250,0.355
27
+ 260,0.3032
28
+ 270,0.2917
29
+ 280,0.2764
30
+ 290,0.3013
31
+ 300,0.2671
32
+ 310,0.3327
33
+ 320,0.2991
34
+ 330,0.2861
35
+ 340,0.3025
36
+ 350,0.3496
37
+ 360,0.2881
38
+ 370,0.3006
39
+ 380,0.324
40
+ 390,0.2913
41
+ 400,0.3258
42
+ 410,0.2738
43
+ 420,0.3317
44
+ 430,0.3038
45
+ 440,0.3158
46
+ 450,0.3064
47
+ 460,0.3135
48
+ 470,0.2704
49
+ 480,0.3385
50
+ 490,0.2702
51
+ 500,0.3148
52
+ 510,0.3148
53
+ 520,0.2817
54
+ 530,0.2909
55
+ 540,0.3225
56
+ 550,0.2749
57
+ 560,0.3026
58
+ 570,0.2592
59
+ 580,0.319
60
+ 590,0.3143
61
+ 600,0.311
62
+ 610,0.2956
63
+ 620,0.2636
64
+ 630,0.2761
65
+ 640,0.301
66
+ 650,0.3012
67
+ 660,0.2803
68
+ 670,0.3498
69
+ 680,0.2677
70
+ 690,0.2762
71
+ 700,0.2753
72
+ 710,0.2797
73
+ 720,0.2969
74
+ 730,0.2734
75
+ 740,0.3026
76
+ 750,0.2967
77
+ 760,0.2725
78
+ 770,0.2647
79
+ 780,0.2746
80
+ 790,0.2983
81
+ 800,0.2957
82
+ 810,0.2736
83
+ 820,0.2849
84
+ 830,0.2611
85
+ 840,0.2441
86
+ 850,0.2607
87
+ 860,0.2368
88
+ 870,0.2535
89
+ 880,0.2556
90
+ 890,0.3219
91
+ 900,0.2858
92
+ 910,0.2894
93
+ 920,0.2816
94
+ 930,0.2575
95
+ 940,0.2794
96
+ 950,0.3195
97
+ 960,0.2826
98
+ 970,0.2974
99
+ 980,0.2766
100
+ 990,0.2964
101
+ 1000,0.2926
102
+ 1010,0.2922
103
+ 1020,0.2921
104
+ 1030,0.2466
105
+ 1040,0.3225
106
+ 1050,0.3113
107
+ 1060,0.2851
108
+ 1070,0.2931
109
+ 1080,0.2725
110
+ 1090,0.3053
111
+ 1100,0.2482
112
+ 1110,0.2892
113
+ 1120,0.251
114
+ 1130,0.2498
115
+ 1140,0.2852
116
+ 1150,0.2556
117
+ 1160,0.2923
118
+ 1170,0.2532
119
+ 1180,0.2488
120
+ 1190,0.2892
121
+ 1200,0.2705
122
+ 1210,0.256
123
+ 1220,0.2573
124
+ 1230,0.2957
125
+ 1240,0.2434
126
+ 1250,0.2487
127
+ 1260,0.279
128
+ 1270,0.2912
129
+ 1280,0.2899
130
+ 1290,0.2868
131
+ 1300,0.2847
132
+ 1310,0.2725
133
+ 1320,0.2594
134
+ 1330,0.2737
135
+ 1340,0.2599
136
+ 1350,0.2764
137
+ 1360,0.2781
training-loss.png ADDED

Git LFS Details

  • SHA256: c9be2cbc8b6b4bf6d2f37ca98c364c9c62abbe9f7ae0549a5e1ceca98d3cc16f
  • Pointer size: 131 Bytes
  • Size of remote file: 113 kB