DarthVaderSenior commited on
Commit
1a72390
·
verified ·
1 Parent(s): 4d7e1fb

Add files using upload-large-folder tool

Browse files
Files changed (3) hide show
  1. README.md +28 -0
  2. ema.safetensors +3 -0
  3. training_data_manifest.txt +5 -0
README.md ADDED
@@ -0,0 +1,28 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ ---
2
+ license: cc-by-nc-4.0
3
+ tags: [world-model, vlm-gym, bagel-7b-mot, maze2d]
4
+ ---
5
+ # maze2d_easy_native256_noncot_chunk_k10_world_model_20260707_perseg (EMA, bf16)
6
+
7
+ Fine-tuned **BAGEL-7B-MoT** action-conditioned visual world model — Maze2d (native 256px, JPEG q95; navigation with stop-required success, easy→hard split).
8
+ Step-5000 EMA weights, **cast fp32 → bfloat16** (inference runs in bf16 autocast — lossless for
9
+ inference). No optimizer state; not a training-resume checkpoint.
10
+
11
+ - **Load into** the BAGEL-7B-MoT architecture (base: `ByteDance-Seed/BAGEL-7B-MoT`).
12
+ - **Training data:** `ultrastar111/maze2d_easy_native256_noncot_chunk_k10_20260707_perseg`
13
+ - **Recipe:** cold start from vanilla BAGEL, lr 2e-5, cosine, warmup 300, 5000 steps, 40k-token
14
+ packing (maze2d cot-K1: 24k), EMA 0.993.
15
+ - **Eval contract:** CoT ckpts need the per-segment decoder (`BAGEL_DECODER=perseg`) + CFG off.
16
+ - License: CC-BY-NC-4.0 (research use).
17
+
18
+ <details><summary>training_data_manifest.txt</summary>
19
+
20
+ ```
21
+ STUDY: Maze2D K-action-chunk feedback-interval (noncot, K=10, difficulty=easy; GT env-feedback re-grounding except K=inf)
22
+ data: /data/home/raychai/hf_datasets/maze2d_easy_native256_noncot_chunk_k10_20260707_perseg/training (q95 baked in; maze2d instruction incl. total-budget + cadence baked in by remap)
23
+ config: ./data/configs/vlm_gym_maze2d_imagined_cot_envfb_train.yaml (envfb loader 'interleaved_cot_envfb', data-dir overridden)
24
+ init: VANILLA /home/jiaxin/unified_world_model/pretrained/BAGEL-7B-MoT (EMA); hparams lr2e-5/warmup100/cosine/total5000/tokens50000/ema0.993/save1000; probe OFF
25
+ git_rev: 0c4fc0786a9c30bfcb8d442261717c0e8d46760c
26
+
27
+ ```
28
+ </details>
ema.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:52f39d331aa20b87fd25fd5043770b2de554ebd89a8170e057a2a68780215f8d
3
+ size 29214685424
training_data_manifest.txt ADDED
@@ -0,0 +1,5 @@
 
 
 
 
 
 
1
+ STUDY: Maze2D K-action-chunk feedback-interval (noncot, K=10, difficulty=easy; GT env-feedback re-grounding except K=inf)
2
+ data: /data/home/raychai/hf_datasets/maze2d_easy_native256_noncot_chunk_k10_20260707_perseg/training (q95 baked in; maze2d instruction incl. total-budget + cadence baked in by remap)
3
+ config: ./data/configs/vlm_gym_maze2d_imagined_cot_envfb_train.yaml (envfb loader 'interleaved_cot_envfb', data-dir overridden)
4
+ init: VANILLA /home/jiaxin/unified_world_model/pretrained/BAGEL-7B-MoT (EMA); hparams lr2e-5/warmup100/cosine/total5000/tokens50000/ema0.993/save1000; probe OFF
5
+ git_rev: 0c4fc0786a9c30bfcb8d442261717c0e8d46760c