aipracticecafe commited on
Commit
6f1c18c
·
verified ·
1 Parent(s): fdf6398

Upload folder using huggingface_hub

Browse files
epoch_155_step_208000/config.json ADDED
@@ -0,0 +1,110 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "_class_name": "sprint_dual",
3
+ "model_type": "sprint_dual",
4
+ "in_channels": 32,
5
+ "hidden_size": 768,
6
+ "depth": 13,
7
+ "num_heads": 12,
8
+ "encoder_depth": 2,
9
+ "decoder_depth": 2,
10
+ "drop_ratio": 0.0,
11
+ "drop_target": "image",
12
+ "residual_type": "concat_linear",
13
+ "hf_text_encoder": "LiquidAI/LFM2.5-230M",
14
+ "hf_vae": "kaiyuyue/FLUX.2-dev-vae",
15
+ "vae_mean": 0.05106564902828182,
16
+ "vae_std": 1.69915383699,
17
+ "resume_from_checkpoint": "epoch_149_step_199320/epoch_149_step_199320",
18
+ "cfg_mask_prob": 0.0,
19
+ "skip_checkpointing_layers": 10,
20
+ "use_random_drop": false,
21
+ "vae_batch_size": 8,
22
+ "use_calibrated_spatial": true,
23
+ "train": {
24
+ "batch_size": 64,
25
+ "lr": 0.0005,
26
+ "epochs": 175,
27
+ "gradient_accumulation_steps": 4,
28
+ "dtype": "fp32",
29
+ "use_checkpointing": true,
30
+ "train_te": false,
31
+ "wd": 0.01,
32
+ "warmup": 0.04,
33
+ "min_lr_ratio": 0.01,
34
+ "reset_scheduler": true,
35
+ "reset_optimizer": false,
36
+ "use_cos_scheduler": true,
37
+ "objective": "flow_matching",
38
+ "timestep_fn": "logit-normal",
39
+ "shift": 1.0,
40
+ "snr_gamma": 5.0,
41
+ "input_perturb": 0.1,
42
+ "cfg_dropout_prob": 0.1,
43
+ "seed": 232,
44
+ "use_bitsandbytes": true,
45
+ "train_only_output": false,
46
+ "skip_save_n_times": 4,
47
+ "run_stability_check": false,
48
+ "world_size": 1,
49
+ "use_ot": false,
50
+ "use_ema": false,
51
+ "ema_decay": 0.999,
52
+ "use_kahan_sum": false,
53
+ "use_cpu_accumulator": false,
54
+ "compile_model": true,
55
+ "gpu_peak_tflops": 165.2
56
+ },
57
+ "data": {
58
+ "dataset_type": "streaming",
59
+ "h5_path": "data",
60
+ "streaming_dataset_name": "aipracticecafe-mirror/curated-danbooru-2026-256px-flux2-vae",
61
+ "num_workers": 6,
62
+ "prefetch_factor": 6,
63
+ "load_into_ram": true,
64
+ "tag_dropout": 0.1,
65
+ "use_shift_crop": true,
66
+ "resolution": 256,
67
+ "buffer_size": 2500,
68
+ "cache_latents_to_ram": true,
69
+ "is_latent": true,
70
+ "precompute_num_workers": 2,
71
+ "precompute_prefetch_factor": 2
72
+ },
73
+ "models": {
74
+ "model_type": "sprint_dual",
75
+ "resume_from_checkpoint": "epoch_149_step_199320/epoch_149_step_199320",
76
+ "output_head_path": null,
77
+ "hf_text_encoder": "LiquidAI/LFM2.5-230M",
78
+ "hidden_size": 768,
79
+ "depth": 13,
80
+ "num_heads": 12,
81
+ "encoder_depth": 2,
82
+ "decoder_depth": 2,
83
+ "drop_ratio": 0.0,
84
+ "drop_target": "image",
85
+ "residual_type": "concat_linear",
86
+ "cfg_mask_prob": 0.0,
87
+ "skip_checkpointing_layers": 10,
88
+ "use_random_drop": false,
89
+ "hf_vae": "kaiyuyue/FLUX.2-dev-vae",
90
+ "vae_mean": 0.05106564902828182,
91
+ "vae_std": 1.69915383699,
92
+ "vae_batch_size": 8,
93
+ "in_channels": 32,
94
+ "use_calibrated_spatial": true
95
+ },
96
+ "paths": {
97
+ "models": "models"
98
+ },
99
+ "logging": {
100
+ "project": "dual-dit",
101
+ "wandb_entity": "aipracticecafe-aipracticecafe",
102
+ "save_interval": 13000,
103
+ "hf_repo": "dual-stream-dit-spatial-rope",
104
+ "wandb_run_name_prefix": "4090-sprint-latents-rope-swap-fine-decay"
105
+ },
106
+ "sampling": {
107
+ "interval": 1300,
108
+ "config_file": "sample.toml"
109
+ }
110
+ }
epoch_155_step_208000/optimizer.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:c55c7cf30311402273b061f1b0a262e236b4a3c7aa8695540475f97fabe809cb
3
+ size 419905931
epoch_155_step_208000/scheduler.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:ba6657df84e5559778da02844febdb9ac018cfaa6eb93f49a396d704a7c7ca68
3
+ size 1721
epoch_155_step_208000/training_state.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:cdc410832eac77437e923b2ec0de6210280eb266560f23d229bf7cb33366b242
3
+ size 1303
epoch_155_step_208000/unet.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:30c248a29fbfa642495e956b4196204d7b9180e7751b133b651c4ef930aa0194
3
+ size 425266512
epoch_165_step_221000/config.json ADDED
@@ -0,0 +1,110 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "_class_name": "sprint_dual",
3
+ "model_type": "sprint_dual",
4
+ "in_channels": 32,
5
+ "hidden_size": 768,
6
+ "depth": 13,
7
+ "num_heads": 12,
8
+ "encoder_depth": 2,
9
+ "decoder_depth": 2,
10
+ "drop_ratio": 0.0,
11
+ "drop_target": "image",
12
+ "residual_type": "concat_linear",
13
+ "hf_text_encoder": "LiquidAI/LFM2.5-230M",
14
+ "hf_vae": "kaiyuyue/FLUX.2-dev-vae",
15
+ "vae_mean": 0.05106564902828182,
16
+ "vae_std": 1.69915383699,
17
+ "resume_from_checkpoint": "epoch_149_step_199320/epoch_149_step_199320",
18
+ "cfg_mask_prob": 0.0,
19
+ "skip_checkpointing_layers": 10,
20
+ "use_random_drop": false,
21
+ "vae_batch_size": 8,
22
+ "use_calibrated_spatial": true,
23
+ "train": {
24
+ "batch_size": 64,
25
+ "lr": 0.0005,
26
+ "epochs": 175,
27
+ "gradient_accumulation_steps": 4,
28
+ "dtype": "fp32",
29
+ "use_checkpointing": true,
30
+ "train_te": false,
31
+ "wd": 0.01,
32
+ "warmup": 0.04,
33
+ "min_lr_ratio": 0.01,
34
+ "reset_scheduler": true,
35
+ "reset_optimizer": false,
36
+ "use_cos_scheduler": true,
37
+ "objective": "flow_matching",
38
+ "timestep_fn": "logit-normal",
39
+ "shift": 1.0,
40
+ "snr_gamma": 5.0,
41
+ "input_perturb": 0.1,
42
+ "cfg_dropout_prob": 0.1,
43
+ "seed": 232,
44
+ "use_bitsandbytes": true,
45
+ "train_only_output": false,
46
+ "skip_save_n_times": 4,
47
+ "run_stability_check": false,
48
+ "world_size": 1,
49
+ "use_ot": false,
50
+ "use_ema": false,
51
+ "ema_decay": 0.999,
52
+ "use_kahan_sum": false,
53
+ "use_cpu_accumulator": false,
54
+ "compile_model": true,
55
+ "gpu_peak_tflops": 165.2
56
+ },
57
+ "data": {
58
+ "dataset_type": "streaming",
59
+ "h5_path": "data",
60
+ "streaming_dataset_name": "aipracticecafe-mirror/curated-danbooru-2026-256px-flux2-vae",
61
+ "num_workers": 6,
62
+ "prefetch_factor": 6,
63
+ "load_into_ram": true,
64
+ "tag_dropout": 0.1,
65
+ "use_shift_crop": true,
66
+ "resolution": 256,
67
+ "buffer_size": 2500,
68
+ "cache_latents_to_ram": true,
69
+ "is_latent": true,
70
+ "precompute_num_workers": 2,
71
+ "precompute_prefetch_factor": 2
72
+ },
73
+ "models": {
74
+ "model_type": "sprint_dual",
75
+ "resume_from_checkpoint": "epoch_149_step_199320/epoch_149_step_199320",
76
+ "output_head_path": null,
77
+ "hf_text_encoder": "LiquidAI/LFM2.5-230M",
78
+ "hidden_size": 768,
79
+ "depth": 13,
80
+ "num_heads": 12,
81
+ "encoder_depth": 2,
82
+ "decoder_depth": 2,
83
+ "drop_ratio": 0.0,
84
+ "drop_target": "image",
85
+ "residual_type": "concat_linear",
86
+ "cfg_mask_prob": 0.0,
87
+ "skip_checkpointing_layers": 10,
88
+ "use_random_drop": false,
89
+ "hf_vae": "kaiyuyue/FLUX.2-dev-vae",
90
+ "vae_mean": 0.05106564902828182,
91
+ "vae_std": 1.69915383699,
92
+ "vae_batch_size": 8,
93
+ "in_channels": 32,
94
+ "use_calibrated_spatial": true
95
+ },
96
+ "paths": {
97
+ "models": "models"
98
+ },
99
+ "logging": {
100
+ "project": "dual-dit",
101
+ "wandb_entity": "aipracticecafe-aipracticecafe",
102
+ "save_interval": 13000,
103
+ "hf_repo": "dual-stream-dit-spatial-rope",
104
+ "wandb_run_name_prefix": "4090-sprint-latents-rope-swap-fine-decay"
105
+ },
106
+ "sampling": {
107
+ "interval": 1300,
108
+ "config_file": "sample.toml"
109
+ }
110
+ }
epoch_165_step_221000/optimizer.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:1be1c281bd649862e1134b699543b401e41933f1730cbc24cdb506edff85d91d
3
+ size 419905931
epoch_165_step_221000/scheduler.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:1b91d83304199b4907e8748e54d41501f2bcbe1f34ce7acd6d35fc6a4e897700
3
+ size 1721
epoch_165_step_221000/training_state.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:2d47e9e83891a52db49de8a811301dbfaf24e4c45282b19af4f5b87661db0582
3
+ size 1303
epoch_165_step_221000/unet.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:2149f0b8fd2514ec113f206da3a040d219e4b23b840c27010fd1a4ab4e330747
3
+ size 425266512
epoch_174_step_233640/config.json ADDED
@@ -0,0 +1,110 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "_class_name": "sprint_dual",
3
+ "model_type": "sprint_dual",
4
+ "in_channels": 32,
5
+ "hidden_size": 768,
6
+ "depth": 13,
7
+ "num_heads": 12,
8
+ "encoder_depth": 2,
9
+ "decoder_depth": 2,
10
+ "drop_ratio": 0.0,
11
+ "drop_target": "image",
12
+ "residual_type": "concat_linear",
13
+ "hf_text_encoder": "LiquidAI/LFM2.5-230M",
14
+ "hf_vae": "kaiyuyue/FLUX.2-dev-vae",
15
+ "vae_mean": 0.05106564902828182,
16
+ "vae_std": 1.69915383699,
17
+ "resume_from_checkpoint": "epoch_149_step_199320/epoch_149_step_199320",
18
+ "cfg_mask_prob": 0.0,
19
+ "skip_checkpointing_layers": 10,
20
+ "use_random_drop": false,
21
+ "vae_batch_size": 8,
22
+ "use_calibrated_spatial": true,
23
+ "train": {
24
+ "batch_size": 64,
25
+ "lr": 0.0005,
26
+ "epochs": 175,
27
+ "gradient_accumulation_steps": 4,
28
+ "dtype": "fp32",
29
+ "use_checkpointing": true,
30
+ "train_te": false,
31
+ "wd": 0.01,
32
+ "warmup": 0.04,
33
+ "min_lr_ratio": 0.01,
34
+ "reset_scheduler": true,
35
+ "reset_optimizer": false,
36
+ "use_cos_scheduler": true,
37
+ "objective": "flow_matching",
38
+ "timestep_fn": "logit-normal",
39
+ "shift": 1.0,
40
+ "snr_gamma": 5.0,
41
+ "input_perturb": 0.1,
42
+ "cfg_dropout_prob": 0.1,
43
+ "seed": 232,
44
+ "use_bitsandbytes": true,
45
+ "train_only_output": false,
46
+ "skip_save_n_times": 4,
47
+ "run_stability_check": false,
48
+ "world_size": 1,
49
+ "use_ot": false,
50
+ "use_ema": false,
51
+ "ema_decay": 0.999,
52
+ "use_kahan_sum": false,
53
+ "use_cpu_accumulator": false,
54
+ "compile_model": true,
55
+ "gpu_peak_tflops": 165.2
56
+ },
57
+ "data": {
58
+ "dataset_type": "streaming",
59
+ "h5_path": "data",
60
+ "streaming_dataset_name": "aipracticecafe-mirror/curated-danbooru-2026-256px-flux2-vae",
61
+ "num_workers": 6,
62
+ "prefetch_factor": 6,
63
+ "load_into_ram": true,
64
+ "tag_dropout": 0.1,
65
+ "use_shift_crop": true,
66
+ "resolution": 256,
67
+ "buffer_size": 2500,
68
+ "cache_latents_to_ram": true,
69
+ "is_latent": true,
70
+ "precompute_num_workers": 2,
71
+ "precompute_prefetch_factor": 2
72
+ },
73
+ "models": {
74
+ "model_type": "sprint_dual",
75
+ "resume_from_checkpoint": "epoch_149_step_199320/epoch_149_step_199320",
76
+ "output_head_path": null,
77
+ "hf_text_encoder": "LiquidAI/LFM2.5-230M",
78
+ "hidden_size": 768,
79
+ "depth": 13,
80
+ "num_heads": 12,
81
+ "encoder_depth": 2,
82
+ "decoder_depth": 2,
83
+ "drop_ratio": 0.0,
84
+ "drop_target": "image",
85
+ "residual_type": "concat_linear",
86
+ "cfg_mask_prob": 0.0,
87
+ "skip_checkpointing_layers": 10,
88
+ "use_random_drop": false,
89
+ "hf_vae": "kaiyuyue/FLUX.2-dev-vae",
90
+ "vae_mean": 0.05106564902828182,
91
+ "vae_std": 1.69915383699,
92
+ "vae_batch_size": 8,
93
+ "in_channels": 32,
94
+ "use_calibrated_spatial": true
95
+ },
96
+ "paths": {
97
+ "models": "models"
98
+ },
99
+ "logging": {
100
+ "project": "dual-dit",
101
+ "wandb_entity": "aipracticecafe-aipracticecafe",
102
+ "save_interval": 13000,
103
+ "hf_repo": "dual-stream-dit-spatial-rope",
104
+ "wandb_run_name_prefix": "4090-sprint-latents-rope-swap-fine-decay"
105
+ },
106
+ "sampling": {
107
+ "interval": 1300,
108
+ "config_file": "sample.toml"
109
+ }
110
+ }
epoch_174_step_233640/optimizer.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:e2e1fb82408bee7d3c5e7b977abca44d1bb40e863667bdea52daeb2d53872013
3
+ size 419905931
epoch_174_step_233640/scheduler.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:0723e5cf7225bb7b234316497d22bd145d0adb3504e3329b9d26f48601c50b11
3
+ size 1721
epoch_174_step_233640/training_state.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:5f0c49dff76f5708b292309856ff68c8e77065b51042889cbe51eed1a9d6f5c6
3
+ size 1303
epoch_174_step_233640/unet.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:28d1980857197a42556ac21a1e5b689cadc26fecd4258f901e8b40dd7a595896
3
+ size 425266512