multimodalart HF Staff commited on
Commit
4de0623
·
verified ·
1 Parent(s): 95cbaca

Upload train_config.json with huggingface_hub

Browse files
Files changed (1) hide show
  1. train_config.json +61 -0
train_config.json ADDED
@@ -0,0 +1,61 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "output_dir": "exp/omnivoice_wordcontrol",
3
+ "data_config": "configs/data_config_wordcontrol.json",
4
+ "llm_name_or_path": "Qwen/Qwen3-0.6B",
5
+ "audio_vocab_size": 1025,
6
+ "audio_mask_id": 1024,
7
+ "num_audio_codebook": 8,
8
+ "audio_codebook_weights": [
9
+ 8,
10
+ 8,
11
+ 6,
12
+ 6,
13
+ 4,
14
+ 4,
15
+ 2,
16
+ 2
17
+ ],
18
+ "drop_cond_ratio": 0.1,
19
+ "prompt_ratio_range": [
20
+ 0.0,
21
+ 0.3
22
+ ],
23
+ "mask_ratio_range": [
24
+ 0.0,
25
+ 1.0
26
+ ],
27
+ "language_ratio": 0.8,
28
+ "use_pinyin_ratio": 0.0,
29
+ "instruct_ratio": 0.0,
30
+ "only_instruct_ratio": 0.0,
31
+ "word_control": true,
32
+ "wc_drop_all_ratio": 0.15,
33
+ "wc_word_drop_ratio": 0.2,
34
+ "wc_attr_keep_ratio": 0.7,
35
+ "resume_from_checkpoint": null,
36
+ "init_from_checkpoint": "k2-fsa/OmniVoice",
37
+ "learning_rate": 5e-05,
38
+ "weight_decay": 0.01,
39
+ "max_grad_norm": 1.0,
40
+ "steps": 40000,
41
+ "seed": 42,
42
+ "lr_scheduler_type": "cosine",
43
+ "warmup_type": "ratio",
44
+ "warmup_ratio": 0.02,
45
+ "warmup_steps": 2000,
46
+ "batch_tokens": 4096,
47
+ "gradient_accumulation_steps": 2,
48
+ "num_workers": 4,
49
+ "mixed_precision": "bf16",
50
+ "allow_tf32": true,
51
+ "use_deepspeed": false,
52
+ "deepspeed_config": null,
53
+ "attn_implementation": "flex_attention",
54
+ "max_sample_tokens": 2000,
55
+ "min_sample_tokens": 50,
56
+ "max_batch_size": 64,
57
+ "logging_steps": 50,
58
+ "eval_steps": 2000,
59
+ "save_steps": 2000,
60
+ "keep_last_n_checkpoints": 3
61
+ }