TianHongZXY commited on
Commit
6798041
·
verified ·
1 Parent(s): 59fc0d8

Upload README.md with huggingface_hub

Browse files
Files changed (1) hide show
  1. README.md +5 -9
README.md CHANGED
@@ -13,12 +13,8 @@ CHIMERA-4B-SFT is [Qwen3-4B-Thinking-2507](https://huggingface.co/Qwen/Qwen3-4B-
13
 
14
  SFT alone accounts for the majority of performance gains across benchmarks. See [TianHongZXY/CHIMERA-4B-RL](https://huggingface.co/TianHongZXY/CHIMERA-4B-RL) for the further RL-trained model.
15
 
16
- | Benchmark | Qwen3-4B-Thinking-2507 | **CHIMERA-4B-SFT** | CHIMERA-4B-RL |
17
- |---|---|---|---|
18
- | GPQA-Diamond | 65.8 | **68.8** | 70.1 |
19
- | AIME 2024 | 81.6 | **86.5** | 86.9 |
20
- | AIME 2025 | **81.0** | 79.8 | 80.7 |
21
- | AIME 2026 | 80.8 | 80.3 | **82.7** |
22
- | HMMT Feb 2025 | 59.2 | 63.1 | **65.7** |
23
- | HMMT Nov 2025 | 57.3 | 66.3 | **67.0** |
24
- | HLE | 7.3 | **9.0** | **9.0** |
 
13
 
14
  SFT alone accounts for the majority of performance gains across benchmarks. See [TianHongZXY/CHIMERA-4B-RL](https://huggingface.co/TianHongZXY/CHIMERA-4B-RL) for the further RL-trained model.
15
 
16
+ | Model | GPQA-D | AIME 24 | AIME 25 | AIME 26 | HMMT Feb 25 | HMMT Nov 25 | HLE |
17
+ |---|---|---|---|---|---|---|---|
18
+ | Qwen3-4B-Thinking-2507 | 65.8 | 81.6 | **81.0** | 80.8 | 59.2 | 57.3 | 7.3 |
19
+ | **CHIMERA-4B-SFT** | **68.8** | **86.5** | 79.8 | 80.3 | 63.1 | 66.3 | **9.0** |
20
+ | CHIMERA-4B-RL | 70.1 | 86.9 | 80.7 | **82.7** | **65.7** | **67.0** | **9.0** |